大腦意念直接發聲!Neuralink「VOICE」試驗重磅突破:ALS 漸凍症患者 Terry「用意念對妻子說我愛你」,Grok 語音克隆復原原聲、事實查核與馬斯克十年技術內幕深度解析

失語漸凍症患者只要「想著」說話,就能用自己過去的聲音開口!Neuralink 正式公布 VOICE 言語重建臨床試驗重大進展,受試者 Terry 透過 N1 腦部植入物將大腦訊號即時解碼為語音,動情對妻子說出「我愛你」。本文深度解析兩階段神經訓練機制、xAI Grok 語音克隆黑科技、社群媒體誤傳「第三位植入者」的事實查核(Community Notes 澄清),以及總裁 DJ Seo 親揭馬斯克十年每週親抓核心架構的幕後內幕。

Share
Neuralink VOICE 臨床試驗參與者 Terry 透過大腦意念發聲對話
Neuralink 官方於 2026 年 9 月公布 VOICE 臨床試驗最新突破:延髓型 ALS 失語患者 Terry 透過 N1 植入物解碼大腦意圖,並以 Grok 語音克隆技術重現生病前的原聲。圖片來源:Neuralink 官方 X 發布。
「在失去說話能力之前,聲音是我們與摯愛溝通的靈魂;當漸凍症奪走了一切,腦機介面給了我重新發聲的奇蹟。

我先試著用嘴型模擬發音,接著只要在大腦中『想著』那些詞句,系統就能解碼我的神經意圖,並用我過去最熟悉的聲音,把這句話傳達給我身邊的人。

這不僅僅是一項技術突破,這是徹底改變生命(Game changer)的救贖。我對我的妻子說:『I love you』。」
—— Terry,Neuralink VOICE 臨床試驗第三位參與者(2026 年 9 月)

Neuralink VOICE 臨床試驗參與者 Terry 透過大腦意念發聲對話
Neuralink 官方於 2026 年 9 月公布 VOICE 臨床試驗最新突破:延髓型 ALS 失語患者 Terry 透過 N1 植入物解碼大腦意圖,並以 Grok 語音克隆技術重現生病前的原聲。圖片來源:Neuralink 官方 X 發布

當一個人的肢體被疾病禁錮、喉嚨發不出任何一絲聲音時,他的思想能否穿透肉體的枷鎖,重新開口向世界說話?

2026 年 9 月,由馬斯克(Elon Musk)共同創辦的神經科技巨頭 Neuralink 向全球投下了一枚震撼彈:在針對言語功能重建的 VOICE(Voice Output Interface for Cerebral Expression) 專項臨床試驗中,罹患肌萎縮性脊髓側索硬化症(ALS,俗稱漸凍症)的參與者 Terry,成功透過腦機介面將純粹的「大腦思維」即時解碼轉化為流暢語音。

更令人動容的是,系統輸出的不是冰冷死板的機器合成音,而是藉助 xAI Grok 生成式語音模型,利用 Terry 患病前留下的真實錄音,完整復原了他原本溫潤自然的原始音色。

在官方公布的展示影片中,Terry 坐在輪椅上,無需動用早已萎縮的聲帶或面部肌肉,僅僅憑藉腦中閃過的念頭,耳邊與揚聲器便傳出了他對摯愛妻子的告白:

「I love you.(我愛你)」

這短短三個詞,讓坐在對面的妻子與現場研究團隊眼眶泛紅,也瞬間引爆了全球社群與醫學界的熱烈迴響。

然而,在這場全球矚目的醫學奇蹟背後,同時交織著主流媒體的報道偏差、X 社群的社群附註(Community Notes)事實查核,以及 Neuralink 總裁 DJ Seo 首度對外界公開的馬斯克十年工程決策內幕。

本文將帶你穿透社群熱搜的喧囂,全方位深度拆解這項劃時代突破:

  1. Terry 是誰?從嘴型模擬到純思維發聲的兩階段神經解碼訓練
  2. xAI Grok 技術如何接入 Neuralink?原聲克隆與自然流暢度的神經音訊架構
  3. 事實查核:Terry 是「Neuralink 第三位受試者」嗎?揭密 VOICE 試驗與 PRIME 試驗的本質差異
  4. DJ Seo 親揭內幕:馬斯克絕非只掛名的金主,十年每週親抓底層架構的核心真相
  5. 早期可行性研究(EFS)與 FDA 監管邊界:腦控語音商業化落地還有哪些現實挑戰?

為了讓讀者快速理解 Neuralink 這次突破在神經復健與人機互動史上的座標,我們先透過下方核心維度對比表,拆解傳統輔助溝通科技與 Neuralink VOICE 的本質代差:

評測維度 傳統眼動儀/按鈕輔具(如 Tobii Dynavox) 傳統非侵入式腦波語音(EEG / fNIRS) Neuralink VOICE 植入式腦控語音(搭配 Grok) 革命性突破與臨床價值
訊號獲取來源 殘存眼球運動、臉頰抽動或紅外線反射 頭皮表面微弱微伏級($\mu\text{V}$)電位 大腦運動/語言皮層 1,024 個電極神經脈衝(Spikes) 穿透頭骨阻隔,獲取高信噪比單神經元等級動作意圖
輸入方式與疲勞度 需長時間凝視螢幕虛擬鍵盤,易造成極度視覺與肌肉疲勞 需高度專注引發 P300 等腦波特徵,校準耗時且不穩定 自然大腦思維(Thought-to-Speech) 告別實體肌肉依賴,從生理根源解放重度癱瘓與閉鎖症候群患者
溝通速度(WPM) 約 5 ~ 15 字/分鐘(逐字凝視拼寫) 約 1 ~ 5 字/分鐘(極慢且錯誤率高) 目標邁向自然語速(60 ~ 100+ 字/分鐘) 溝通效率提升數倍,打破過往「一分鐘只能敲一句話」的對話天花板
輸出聲音質感 機械化、單調的金屬機器合成音(如史蒂芬·霍金的經典合成音) 僅能觸發預設預錄短語或機器音 復原患者患病前真實「原聲」(Original Voice) 💖 重拾個人身分認同(Identity),維繫病患與家人間的情感連結
語意理解與自動校正 無 AI 輔助,打錯字需手動回退修正 簡單統計語言模型(N-gram),泛化能力極差 整合 xAI Grok 大模型上下文預測與語音平滑技術 即時容錯校正,補齊神經噪聲引起的解碼波動
裝置型態與便攜性 依賴外掛螢幕、紅外線攝影機,擺放位置要求嚴格 需塗抹導電膠、佩戴笨重頭戴式電極帽 頭骨全埋入式 N1 晶片 + 隱形無線感應線圈 外觀完全隱形,透過無線藍牙連接日常終端
臨床監管狀態 已廣泛商業銷售、納入多國醫保 部分科研設備或專利,臨床效能有限 FDA 早期可行性研究(EFS)/IDE 臨床驗證中 尚未獲得 FDA 全面上市批准,屬前沿探索階段

二、Terry 的救贖之路:從 2024 年確診漸凍症到「意念發聲」

1. 殘酷的疾病:延髓發病型 ALS 的無聲牢籠

要理解 Terry 的奇蹟,必須先理解肌萎縮性脊髓側索硬化症(ALS)對人體神經系統的毀滅性打擊。

ALS 是一種進行性神經退化性疾病,主要侵犯大腦皮層、腦幹與脊髓中的運動神經元。當這些負責支配骨骼肌的神經細胞逐漸凋亡後,大腦發出的指令便再也無法傳遞至肌肉,導致全身肌肉逐漸萎縮、無力與癱瘓。

而在 ALS 的各種類型中,延髓發病型(Bulbar-onset ALS) 最為殘酷。與常見的肢體無力不同,延髓發病型病患首先受損的是支配舌頭、下顎、喉部與聲帶的下運動神經元。

這意味著:

  • 患者往往在四肢仍能勉強活動時,就已經完全失去了說話能力(Anarthria)
  • 伴隨吞嚥困難、唾液嗆咳,最後甚至無法做出清晰的臉部表情;
  • 但與此同時,患者的大腦思維、認知能力與情感感知卻完全清醒——宛如一個健全的靈魂,被活生生反鎖在逐漸沉寂的軀殼之中。

Terry 於 2024 年正式被確診罹患此症。在接下來的幾個月內,他的語言能力迅速崩塌,從吐字不清演變為徹底失語。日常溝通只能依賴緩慢的筆寫或眼動儀,但眼動拼字不僅每分鐘只能敲出寥寥數語,更無情抹去了他作為丈夫、父親原本獨一無二的說話語調與聲音溫度。

2. 官方展示實錄:Terry 意念發聲震撼瞬間

在官方發布的完整紀錄影片《SPEAKING WITH THE MIND》中,Terry 親自展示了自己如何透過 N1 植入物重新與妻子、研究人員流暢對話:

Neuralink 官方發表影片《SPEAKING WITH THE MIND》:延髓型 ALS 患者 Terry 透過大腦意念即時解碼發聲,重現個人原聲對話。影片來源:Neuralink 官方 YouTube官方 X


3. 兩階段神經重塑訓練:從「模擬發音」到「純思維發聲」

2026 年初,Terry 通過嚴格篩選,正式加入 Neuralink 的 VOICE 專項臨床試驗。由神經外科團隊透過 R1 手術機器人,將擁有 1,024 個微米級柔性電極的 N1 植入物,精準埋植於 Terry 大腦中負責運動規劃與發音肌肉支配的皮層區域。

然而,植入晶片只是第一步。大腦神經元在肌肉癱瘓後,如何重新與數位解碼器建立對應關係?Neuralink 團隊與 Terry 展開了一場令人讚嘆的兩階段神經校準訓練

Neuralink VOICE 試驗大腦意念直連語音全管線架構圖
Neuralink VOICE 試驗大腦意念直連語音全管線架構:從延髓型漸凍症大腦皮層神經脈衝,到 N1 晶片採樣、兩階段適應性訓練,最後由 xAI Grok 原聲克隆輸出「I love you」。圖片來源:雷司紀科技專欄繪製整理。

第一階段:模擬動作發聲(Miming Words)

在植入後初期,研究人員要求 Terry 盯著螢幕上的提示文字,盡其所能地用嘴型去「模擬」發音動作。
雖然延髓神經受損導致聲帶無法震動、舌部肌肉無法協調發聲,但當 Terry 嘗試做出動作時,大腦皮層神經元依然會產生極為清晰的發火模式(Neural Firing Rates)。N1 植入物的 64 根柔性超細線(Threads)捕捉了這 1,024 個通道的高頻神經訊號,演算法藉此記錄下每個音素(Phoneme)對應的神經特徵指紋。

第二階段:純思維發聲(Pure Thought Speech)

當演算法建立了穩定的基礎特徵庫後,訓練進一步躍遷至真正意義上的「腦機合一」:
Terry 不再需要費力動用嘴唇或臉部肌肉,他只要在心中「想著」這句話,神經解碼器就能直接捕捉到運動想像(Motor Imagery)訊號。
這解決了漸凍症患者最恐懼的難題——即便未來病情惡化導致面部肌肉徹底癱瘓,純思維的解碼途徑依然能保持暢通,真正打破了漸凍症造成的終極禁錮!


三、Grok 語音克隆接入:不只重構對話,更復原「個人靈魂」

在過去幾十年的腦機介面研究中,言語重建往往面臨一個令人遺憾的妥協:即使成功解碼,輸出也只能是像史蒂芬·霍金(Stephen Hawking)那樣冰冷、單調的金屬機器音(Robotic Synthesizer)。

對於失語病患及其家屬而言,這種機器音雖解決了訊息傳遞,卻徹底斬斷了聲音背後所蘊含的**個人身分認同(Identity)**與情感厚度。

這次 Terry 測試的最耀眼之處,正是 Neuralink 神經工程與 xAI 的 Grok 生成式 AI 技術深度融合

1. 「Original Terry」:患病前音檔的個人化聲學克隆

團隊在試驗開始前,蒐集了 Terry 在 2024 年確診生病之前所留下的家庭錄影、通話紀錄與語音訊息。
xAI 團隊將其整合進 Grok 語音架構中的神經聲學合成模組:

  • 提取 Terry 獨特的基頻(Pitch)、共振峰(Formants)、說話節奏與口音特徵;
  • 構建專屬的高保真神經聲碼器(Neural Vocoder)個人先驗權重;
  • 當腦機介面解碼出神經音素序列時,Grok 可以在百毫秒內的超低延遲下,將乾燥的文字音素轉化為富有語氣起伏、帶有 Terry 標誌性音色的自然語音。

2. 生成式 AI 的容錯與預測補全

大腦神經訊號本質上充滿噪聲與動態漂移。如果單純依賴傳統分類器,一旦某個神經脈衝解碼錯誤,輸出的字詞就會破碎不堪。

Grok 在管線中扮演了「大腦的智慧後級」:

  • 上下文語意預測(Contextual Autocomplete):結合對話情境,即時預測病患最可能發出的單詞,降低解碼錯誤率;
  • 語音平滑技術(Acoustic Smoothing):消除神經訊號微弱波動造成的聲音卡頓,輸出如同常人般連貫的呼吸感與氣息音。

當 Terry 在腦海中思索「I love you」時,揚聲器傳出的,正是多年前那個健康的丈夫對妻子說話時熟悉的音調。這種技術賦予的情感尊嚴,讓 Terry 忍不住激動表示:「這是一場真正的 Game Changer,我懇請所有人全力支持 ALS 醫療研究!」


在 ABC News 等知名主流國際媒體發布快訊後,社群平台上瞬間瘋傳:
「Terry 是全球第三位植入馬斯克 Neuralink 晶片的人類!」

然而,這項說法隨即遭到了 X 社群的 Community Notes(社群附註) 標註事實糾錯,Neuralink 官方也進一步給出了澄清。這是一起極具代表性的醫學報導概念混淆

社群熱搜真相拆解:事實查核闢謠與馬斯克十年工程內幕
社群熱搜真相拆解:X 社群附註(Community Notes)及時釐清 Terry 的試驗分流身分,以及 Neuralink 總裁 DJ Seo 親自證實馬斯克每週親抓底層工程技術。圖片來源:雷司紀科技專欄繪製整理。
  • 已植入數十人:截至 2026 年,Neuralink 在美國多家頂級醫學中心(包括巴羅神經學研究所、UT Southwestern 等)推進臨床試驗,累計植入 N1 晶片的受試者總數已達數十人(Dozens of patients)
  • 試驗分流
    • PRIME 試驗(Precision Regulated Implant Motor Evaluation):專注於運動皮層運動區(Hand Knob 區域等),主要恢復四肢癱瘓者的電腦游標操控、電競、手機操作以及電動輪椅驅動;
    • VOICE 試驗(Speech Restoration):專注於支配面部肌肉與語言意圖皮層,專為 ALS、中風或創傷性腦損傷(TBI)導致嚴重失語的患者設計。
  • 正確事實Terry 是 Neuralink「VOICE 言語重建試驗」的第三位參與者,而非 Neuralink 總體歷史上的第三位植入者。

這種釐清非常重要。它反映出 Neuralink 的臨床研究並非停留在初期的單一個案展示,而是已經形成了多管齊線推進的矩陣式醫療研發體系


五、DJ Seo 親揭內幕:馬斯克絕非甩手金主,十年每週親抓核心架構

在社群媒體圍繞 Terry 展開熱烈討論之際,知名科技觀察家 Robert Scoble(@Scobleizer)在 X 上對馬斯克在 Neuralink 內部究竟扮演何種角色提出了探討。

對此,Neuralink 共同創辦人兼總裁 DJ Seo(徐東真) 親自下場發表了重磅回應,揭露了這家神經科技巨頭過去十年不為人知的工程日常。

1. 每週深入一線:技術會議不是聽簡報,而是直面底層物理學

DJ Seo 在回覆中明確指出:

"Elon made some of the key technical decisions and still does to this day. We meet with him weekly (often more frequently). He goes deep with the team and contributes significantly. I don’t know how he does this, but he just makes it happen. Consistently for the past 10 years."
(Elon 制定了許多關鍵技術決策,直到今天依然如此。我們每週都會與他開會,頻率往往更高。他與團隊一起深挖技術細節,做出了極為重大的貢獻。我不知道他是如何兼顧這一切的,但他就是能做到這一點——在過去的十年間始終如一。)

從 DJ Seo 與核心工程師歷年來的專訪中可以歸納,馬斯克對 Neuralink 的介入深刻體現在三個根本性底層決策上:

  1. 堅持「完全植入式」無外露設計(No External Connectors): 在 Neuralink 創立初期,學術界主流植入式腦機介面(如 Utah Array)都需要在病患頭皮上固定一個凸出的基座(Pedestal),再插上厚重的排線連接外置設備。
    馬斯克在十年前便強硬推翻了這種方案,堅持必須是將硬幣大小的 N1 晶片全埋入顱骨、外表完全看不出任何異樣、透過無線充電與藍牙傳輸的現代消費級工業美學。這一要求在當時被醫學界視為天方夜譚,但正是這項堅持奠定了 Neuralink 今日的實用性。
  2. 開發高吞吐柔性電極細線與 R1 手術機器人: 為了避免硬質金屬針刺傷大腦引起膠質疤痕增生,Neuralink 採用了比頭髮還細數倍的聚合物微絲。但由於細線過於柔軟無法徒手插入大腦,馬斯克拍板決定投入重金研發仿若精密縫紉機的 R1 手術機器人,以光學相干斷層掃描(OCT)避開皮層微血管自動縫合。
  3. 推動生成式 AI 與神經晶片的橫向整合: 馬斯克麾下跨越特斯拉(FSD 視覺模型)、xAI(Grok 大模型)與 Neuralink。在言語重建這條線上,馬斯克直接促成了 xAI 音訊團隊與 Neuralink 解碼團隊的對接,讓先進的語音大模型第一時間下沉到神經接口,大幅縮短了研發週期。

六、從奇蹟回到現實:VOICE 試驗目前已證實什麼?還有哪些未知數?

面對震撼的演示,科技媒體往往容易陷入狂熱。但作為具備醫學嚴謹性的科技評估,我們必須清醒劃分「已被實驗證實的能力」與「尚未被證實的長期風險」。

下表詳細梳理了 Neuralink VOICE 試驗目前的真實邊界:

類別 已由官方展示或臨床數據支持的事實 目前仍未證實或面臨的嚴峻考驗
神經訊號解碼 • 受試者可透過模擬動作與純思維驅動解碼
• 1,024 通道電極可分離出言語運動意圖
• 可連續即時解碼基本詞彙與情感語句
• 詞彙庫容量(Vocabulary Size)尚未達到日常數萬詞無約束狀態
• 長時間疲勞、情緒波動對解碼準確率的影響尚無量化統計
語音生成品質 • 藉由 Grok 成功復原 Terry 患病前的標誌性音色
• 能夠自然念出「I love you」等高頻生活用語
• 語音合成的端到端延遲是否能在複雜對話中保持人類級流暢(< 200ms)
• 能否表達細微的幽默、諷刺或強烈語氣變化
硬體與生物相容性 • N1 晶片可在人體內透過無線感應供電與傳輸
• 柔性細線在人體頭骨與硬膜下維持初期運作
電極絲微縮退(Thread Retraction):先前 PRIME 試驗曾出現部分電極絲因腦組織微幅位移而脫落的現象,長期訊號穩定度仍需數年觀察
• 電極周圍長期發炎反應與訊號衰減(Signal Drift)
法規與商業化 • 獲得美國 FDA 批准的 早期可行性研究(EFS)
• 在 研究用醫療器材豁免(IDE) 架構下合法開展試驗
尚未取得 FDA 上市核准(PMA)
• 任何大眾目前均無法自費預約手術或購買
• 距離全面商業保險給付與常規醫療應用仍需數年嚴格三期試驗

七、神經科技新紀元:腦機介面正在重寫人類的表達邊界

從 2024 年初 Noland Arbaugh 用大腦意念下西洋棋、打《文明帝國》,到 2026 年中癱瘓受試者用意念駕駛電動輪椅自由移動,再到今日 Terry 透過大腦意念讓患病前溫柔的嗓音重新對妻子道出「我愛你」——腦機介面正在以超乎所有人預期的速度,一步步收復那些曾被絕症徹底剝奪的人性尊嚴。

這項突破的深遠意義在於:

  1. 證明了「大腦語言直連」的可行性:我們不再需要依賴肢體、眼球或殘存肌肉作為中介,思想本身就可以直接變成聲波;
  2. 標誌著 AI 大模型與神經工程的歷史性會師:硬體負責獲取乾淨的神經生物電訊號,生成式大模型負責理解語境、容錯降噪並還原人性化的表達,兩者的化學反應將徹底重塑未來的輔具生態;
  3. 為更多神經退行性疾病帶來曙光:無論是漸凍症、嚴重中風引發的失語症,還是各類腦幹損傷導致的閉鎖症候群,這扇由高帶寬腦機介面推開的窗戶,正為那些困在黑暗中的靈魂注入前所未有的希望。

正如 Terry 在重獲新聲後對世界發出的呼籲:腦機介面的每一次微小進步,背後都是數以萬計深陷困境的患者與家庭的殷切企盼。隨著技術的持續迭代、法規臨床數據的積累與工程架構的成熟,我們有理由相信,那個「沒有任何靈魂會被永久囚禁在無聲世界」的未來,正加速到來。


常見問題 FAQ

A:Terry 是 Neuralink 專項 VOICE(言語重建)臨床試驗的第三位受試者,並非 Neuralink 歷史上的第三位植入者。截至 2026 年,Neuralink 在其運動控制(PRIME)、輔具整合等多項臨床試驗中,累計植入的受試者總數已達數十位。

Q2:Terry 是如何做到「用過去自己的聲音說話」的?

A:這是 Neuralink 神經訊號解碼系統與 xAI Grok 生成式語音模型 的聯合成果。研究團隊在手術前蒐集了 Terry 於 2024 年確診 ALS 前留下的家庭錄音,提取其特有的音高、音調與口音特徵訓練出專屬模型;當 N1 晶片解碼出 Terry 大腦中的意圖音素後,由 Grok 即時渲染出高度擬真的原始音色。

Q3:Terry 必須在腦中一個字母一個字母拼寫單詞嗎?

A:不需要。VOICE 試驗的目標是邁向自然語速的言語解碼。Terry 在經過第一階段的「模擬發音動作」校準後,進入第二階段可直接在大腦中想像完整單詞與句子的發音意圖,神經網路即時將皮層神經脈衝序列映射為語音音素與詞彙。

Q4:這項技術現在可以向醫院自費申請手術了嗎?

A:目前完全不行。該裝置仍屬於美國 FDA 監管下的研究用醫療器材(Investigational Device),僅在早期可行性研究(EFS)與 IDE 框架下對符合條件的特定志願受試者開放。目前尚未通過 FDA 商業上市許可,一般大眾或非試驗病患尚無法購買或自費接受植入。

A:根據 Neuralink 總裁 DJ Seo 於 2026 年 9 月在 X 平台上的公開說明,馬斯克過去十年每週(甚至更高頻率)與工程團隊深入召開技術會議,直接參與全植入式無外露架構、R1 機器人自動縫合等關鍵架構選型與工程決策,是深度推動專案進展的核心技術主導者之一。


參考來源與延伸閱讀

Read more

Cua 官方正式開源首款電腦控制專用系統一模型 CUA-S1-FORMS

70 萬參數逆襲千億巨獸!Cua 重磅開源首款電腦控制「系統一」模型 CUA-S1-FORMS:2.8MB 極限輕量、單次前向平行填表與終結雲端 LLM 延遲深度解析

當前 Computer Use 陷入「用千億參數雲端大模型點擊輸入框」的算力與延遲泥淖!YC S25 孵化團隊 Cua 正式開源首款系統一模型 CUA-S1-FORMS。僅 706k 參數、2.8 MB 檔案大小,捨棄逐字自回歸生成,單次前向瞬間平行打分;實測合成準確率 99.95%、真實表單 100% 滿分命中,全面超越 TypeSafe Jev API!本文深度拆解 TinyTransformerScorer 架構、反混淆數據集引擎、Cua Driver 本地零延遲後台執行,以及混合 Agent 車隊未來。