魏茨曼研究所開發AI工具 可從腦掃描重建所見圖像
研究團隊以8名受試者、每人約9000張圖像的fMRI數據訓練模型,重建人眼所見畫面,並可由圖像預測腦部活動。
以色列魏茨曼科學研究所(Weizmann Institute of Science)的Michal Irani與同事開發出一套AI工具,能從腦部掃描重建一個人正在看的畫面;這套工具也能反過來,根據一個人正在看的圖像預測其腦部活動。相關內容由technologyreview.com報導。
研究團隊以8名受試者的數據訓練AI模型。這8人各自在高解析度fMRI掃描儀中觀看了約9000張圖像。
這套腦解碼器分為兩個分支:一個預測圖像的結構,另一個預測圖像的內容。之後再由一個擴散模型(diffusion model)根據這些預測產生重建圖像。
團隊同時訓練了一個編碼器,可從圖像預測腦部活動,並將它與解碼器搭配使用,讓兩項工具的效果都獲得提升。
既有研究的限制
神經科學家多年來一直嘗試用fMRI重建人們看到的畫面,早期成果只能產生模糊圖像。過去也有其他研究團隊在fMRI掃描儀中讓志願者觀看數百張圖像並收集掃描數據,並打造出從腦掃描資料重建圖像的工具,但Irani認為這些工具的精確度仍不足。