
來源:科技日報
據美國每日科學網站近日報道,有史以來第一次,美國科學家研制出的一套新系統,借助語音合成器和人工智能,通過監控某人的大腦活動,将其想法直接轉化成了可理解、可識别的語音。研究人員稱,研究為那些言語能力有限或無法說話的人重新獲得與外界溝通的能力奠定了基礎,也有望為計算機直接與大腦通信開辟新途徑。
幾十年的研究表明,當人們說話(甚至想象說話)時,大腦中會出現明顯的活動模式。當我們傾聽某人說話或想象聆聽時,大腦也會出現可識别的信号模式。專家們試圖記錄和解碼這些模式,希望将人們的想法翻譯成口頭語言。
但實現這一壯舉極具挑戰性。以前科學家進行的腦部信号解碼工作主要集中于構建一些用于分析頻譜圖(聲音頻率的視覺表示)的簡單計算機模型,但這種方法不能産生任何類似于可理解的語音的東西。哥倫比亞大學莫蒂默•B。祖克曼心腦行為研究所的莫斯尕拉尼團隊因此求諸聲碼器,這是一種計算機算法,可在接受人們說話的錄音訓練後合成語音。
為了教聲碼器解釋大腦活動,莫斯尕拉尼與神經外科醫生阿希什•迪勒希-梅塔合作。在研究中,他們要求接受過腦部手術的癫痫患者聽取不同人說的句子,同時測量他們大腦的活動模式,這也是對聲碼器進行訓練。
接下來,他們要求這些患者聽說話者複述0到9之間的數字,同時記錄可以通過聲碼器運行的大腦信号。然後,再借助模仿生物大腦中神經元結構的人工智能——神經網絡,對聲碼器響應這些信号所産生的聲音進行分析。
莫斯尕拉尼說:“我們發現,這些人可以理解并重複75%的聲音,遠超以往任何嘗試。”
研究人員計劃接下來測試更複雜的單詞和句子。他們希望該系統可以成為植入物的一部分,将穿戴者的思想直接轉化為文字。
莫斯尕拉尼說:“這将改變遊戲規則。它有望讓任何失去講話能力的人,重新擁有與周圍世界聯系的機會。”
免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

