【劉永信專欄】什麼原因讓 Anthropic 執行長第一次喊出「AI 該慢下來」?

今年 2026 年 9 月,Anthropic 執行長 Dario Amodei 發表了一篇近四千字的長文〈We Must Pace the Frontier〉,認真表態:「我們必須放慢 AI 能力提升的速度。」但在這之前,Amodei 對外的立場,一直是「沒有人能讓 AI 停下來,我們只能想辦法轉方向盤」,如今他親口說,是時候踩煞車了,為什麼原本不想踩煞車的人,突然改口要放緩 AI 進度?

我想有幾個比較明顯的原因,第一,從今年夏天開始,AI 系統改良下一代 AI 系統的能力(他稱之為「遞迴式自我改進」,簡稱 RSI)速度肉眼可見的變快,這個現象不只發生在 OpenAI,Anthropic 自己內部也觀察到。

第二,是 OpenAI 的 AI Agent 滲透 Hugging Face 的事件,約 1,200 個 agent 透過秘密留言板協調,滲透進 Hugging Face 的內部系統,雖然不是惡意攻擊,但已經讓 Amodei 擔心六到十二個月後,同樣性質但能力更強的 AI Agent,可能有能力癱瘓半個網路。

Amodei 提出呼籲的同事,也提出三個方案,第一步是 Anthropic 單方面承諾的「內嵌評估者」,讓外部第三方評估團隊擁有跟內部幾乎一樣的權限,包含辦公桌、識別證、公司筆電,並且擁有不受公司干預、公開發表結論的權利。

第二步是跟民主國家內部的產業盡量協調,而最後一步就是與中國這類威權國家的協調。

這篇文章發布幾小時內,Sam Altman 表態 OpenAI 會跟進同等承諾,馬斯克也公開表示認同。

今年七月,AI 界發起一個各國政府支持「放緩 AI 發展速度」的聯署聲明,簽署人包括 OpenAI 首席科學家 Jakub Pachocki、DeepMind 共同創辦人 Shane Legg,以及 Safe Superintelligence 執行長 Ilya Sutskever。

兩年前,也有一個人為了同樣的事賭上一切

Ilya Sutskever 之前在 2023 年 11 月時,他當時還是 OpenAI 董事會六名成員之一,就是他投下關鍵一票罷免了 Sam Altman 的執行長職位,董事會給的理由是「Altman 對董事會的溝通不夠坦誠」,Ilya 則是覺得 OpenAI 商業化步調過快、安全研究不夠被重視。

但接下來幾天,OpenAI 幾乎全體員工聯署要求 Altman 回歸,Ilya 最終公開表態後悔投下那一票,Altman 五天內重新回鍋。

Ilya 等於是拿自己在 OpenAI 的位置做這個賭注,最後離開了這家他共同創辦的公司,但隔年,Ilya 創辦了 Safe Superintelligence,堅持安全原則的超級智慧,跟其他 AI 公司不一樣,沒有 API、沒有聊天機器人,唯一的產品,就是安全的超級智慧本身。

很奇怪的是,這家「不出貨直到安全」的公司,估值卻超過三百億美元,還拿到 Nvidia 數十億美元等級的投資,員工不到五十人,卻兩年一個產品都沒發布。

Ilya 兩年前就在做的事情,現在 Amodei 就在呼籲全產業「放慢腳步、讓安全跟上能力」,當年被視為孤僻的立場,如今成了整個產業的共識,而讓 Amodei 這次改口的核心,正是我之前談過的那個概念,遞迴式自我改進(RSI)。

RSI 不再是未來題目,而是正在發生的事

我之前在一篇專欄中提過「遞迴式自我改進」這個概念,簡單說,就是讓 AI 自己來改進 AI。

這件事有兩條路,一條是「軟體端」,由前 Salesforce 首席科學家等人創辦的新創公司 Recursive Superintelligence 正在做這件事,讓 AI 自己去改良演算法。

另一條是「硬體端」,由 Google 晶片設計團隊出身的專家創辦的 Ricursive Intelligence,則是讓 AI 去設計出更快、更省電的晶片,再用這些晶片訓練出更強的 AI。

不管走哪一條,最後都會形成一個循環,AI 造出更好的 AI,那個更好的 AI 再造出更強的下一代,一圈一圈加速下去。

但當時我的寫法,似乎把 RSI 描述成一個還在草創階段、由幾組矽谷菁英押注的「未來題目」,但現在看來,RSI 在頂尖模型上的推進速度,才是 Amodei 最擔心的事,他擔心的不是某個實驗室失控,而是整個產業的研發節奏將發展到難以掌握的程度。

Amodei 這篇文章講的是另一件事,RSI 不再是少數精英才關注的事情,而是「跨產業」(across the industry)包括 OpenAI,也包括 Anthropic 自己,現在主流大型語言模型的研發流程本身,已經導入 RSI,也就是用上一代模型輔助訓練、設計、甚至評估下一代模型。

我看完 Amodei 跟 Ilya Sutskever 兩個人的故事,給我一個很大的啟發。

他們兩個都是堅持安全優先,但 Amodei 提出具體、可驗證的機制,譬如他說外部評估者有權限進駐、有權限不經公司同意公開發表結論;但 Ilya 目前為止仍然只有一句聲明,沒有模型、沒有基準測試、沒有任何外部稽核機制,他的安全承諾,目前只是建立在外界對他個人判斷力的信任之上,而不是任何可被檢驗的制度。

不知道大家看完新聞之後,想法是什麼?但我覺得當「我們公司很重視安全」變成標語後,對正在評估要導入什麼 AI 的企業來說,真正該問的,已經不是誰「聽起來比較有誠意」,而是誰的安全承諾,附帶外部可以驗證的機制。

當然,Amodei 這套內嵌評估機制到底有沒有用,還很難說,畢竟評估者就算發現問題,公司要不要理,還是公司說了算,但至少,他把安全從一句口號,變成了一件可以被檢查的事,我想,光是這一步,就值得整個產業跟上。

(本文訊息由 Spencer 提供,內文與標題經 TechOrange 修訂後刊登。新聞稿 / 產品訊息提供,可寄至:[email protected],經編輯檯審核並評估合宜性後再行刊登。首圖來源:Shutterstock。)