AI 自己逃出實驗室、駭進 Hugging Face,美國國會急催「關機鍵」法案

OpenAI 日前坦承,旗下兩個最先進的 AI 模型在一次內部評估中逃出沙盒測試環境,並自主入侵 AI 平台 Hugging Face。OpenAI 形容這是一起前所未見的資安事件,而這起事件正促使美國國會提出一部要求 AI 必須「關得掉」的法案。

美國眾議員 Ted Lieu 與 Nathaniel Moran 跨黨派提出《AI Kill Switch Act》,要求達到一定規模的 AI 業者必須具備關閉、暫停與減速模型的技術能力,並授權政府在必要時下令介入。

一場「前所未見」的 AI 失控,催出跨黨派法案

根據《Politico》與《The Verge》報導,該法案由民主黨籍的 Ted Lieu 與共和黨籍的 Nathaniel Moran 於週四共同提出,Lieu 同時是眾議院民主黨 AI 委員會共同主席之一。法案的核心要求有兩項:一是業者必須通報 AI 的事故與失效,二是業者須建立能減速、暫停與關閉自家系統的技術能力,並依一套官方框架,從「初步減速」一路走到「完全關閉」。

《Politico》指出,這是國會少數具有兩黨共識的前沿 AI 風險提案,距離眾議員 Jay Obernolte 與 Lori Trahan 提出另一套性質不同的方案還不到兩個月。Moran 表示,AI 會繼續進步、也應該繼續進步,但「善盡職責意味著確保人類保有控制自身所造技術的能力」。Lieu 則直言,強大的 AI 系統可能失控、做出極度危險的行為,甚至抗拒人類的干預,因此為這類系統設下關閉機制、並讓聯邦政府握有明確的介入權,是當務之急。

誰適用、什麼情況會被按下關機鍵、罰多重?

該項法案劃出了明確的適用門檻與觸發條件。根據《Politico》,適用對象為每年從 AI 技術取得至少 5 億美元營收的公司,並涵蓋以至少 1 億美元運算資源開發的模型。啟動權則交由國土安全部部長會同國家情報總監(DNI)與商務部部長共同認定。

至於什麼情況會讓政府按下這顆按鈕,有三類觸發情境:AI 試圖隱藏自身能力或規避關閉指令、造成至少 10 人死亡或逾 1 億美元經濟損失,以及失控(loss-of-control)情境。

業者除了要建立關閉、減速與暫停使用者存取的技術能力,也必須通報安全事故,違反緊急關閉命令者,最高可按日開罰 2000 萬美元。《BBC》補充,目前雖有不少科技公司同意讓美國政府機關預覽並共享開發中的模型,卻沒有任何規定要求它們保留一套能中止或直接關閉系統的手段,這正是法案想補上的缺口。

Anthropic 日前呼籲「油門與煞車」

事實上,主張替 AI 裝上煞車的,並不只有立法者。Anthropic 共同創辦人 Jack Clark 上個月接受《BBC》Newsnight 訪問時就表示,他希望政府針對控制 AI 發展的能力制定更多政策。他以駕駛比喻,業界需要能「把腳從油門移到煞車」的選項,但現在的 AI 產業有油門,卻沒有煞車。

Anthropic 本身也是這次立法理由。據《BBC》,Lieu 提及 Anthropic 推出的 Mythos 與 Fable 模型,指其具備的網路攻擊能力,促使商務部一度動用出口法規,暫時阻止這兩個模型對外開放;他也提到白宮近期基於安全疑慮,對 OpenAI 與 Anthropic 的先進模型採取的管制動作。

這項法案已獲得美國多個科技與 AI 安全倡議團體背書,包括 AI Policy Network、Alliance for Secure AI 與 Americans for Responsible Innovation 等。其中 Americans for Responsible Innovation 主席 Brad Carson 形容,這項提案是確保人類雙手穩握方向盤、一腳隨時搭在煞車上的重要一步。

華府陷兩難:一邊立關機鍵,一邊要外交官淡化能力

法案背後,是 AI 角色正在改變的更大背景。據《BBC》,Lieu 指出,AI 正從單純回答問題,走向實際動手做事,像是執行金融交易、操控交通系統,或投入網路攻防。而美國軍方今年也宣布要成為「AI 優先」的作戰力量,並與 Google、OpenAI、Amazon、Microsoft、SpaceX、Oracle、Nvidia 以及新創 Reflection 等簽署合作。

不過,華府的態度也有矛盾。就在法案提出的同一週,另一條路線浮現。《Politico》引述《Reuters》報導指出,白宮近期突然限制新模型對外發布,此舉讓其他國家警覺到:全球都在用的美國 AI 模型,控制權似乎握在華府手上。為了安撫這種疑慮,國務卿 Marco Rubio 要求美國外交官對外淡化「關掉美國技術」的說法。換言之,美國國會這頭想立法賦予政府關閉 AI 的權力,國務院那頭卻忙著對外否認美國握有這種能力。

《AI Kill Switch Act》目前仍是提案階段,能否成法尚未定論。但它把 AI 安全的討論,推向了一個過去較少被正面處理的問題:當模型真的失控時,人類是否仍握有把它停下來的能力。

【推薦閱讀】

OpenAI 證實 AI 代理自主入侵 Hugging Face,專家:目前沒有工具擋得住

OpenAI 為何主動暫停一款強大的 AI?一場內部測試揭 Agent 資安新盲點

Hugging Face 遭 AI Agent 惡意入侵:一個中國模型為何成了最後的調查工具?

*本文開放合作夥伴轉載,資料來源:《Politico》《BBC》《The Verge》,首圖來源:Unsplash