OpenAI、Anthropic 千名頂尖科學家聯署要求「放慢 AI 發展」,發生什麼事?

Crumax
分享
OpenAI、Anthropic 千名頂尖科學家聯署要求「放慢 AI 發展」,發生什麼事?

OpenAI、Anthropic、Google DeepMind、Meta 等美國頂尖人工智慧公司逾千名員工,包括多位科學家與共同創辦人,在今日(29)發佈聯署聲明,要求美國政府推動國際合作,建立技術與政策工具,以調控自動化 AI 的研發速度,引發外界猜測動機為何。

AI 巨頭聯合聲明:為何突然踩煞車?

據悉,聲明並未明確要求政府暫停或減緩 AI 開發,但要求保留「能隨時放慢 AI 技術推進」的選項。聲明原文指出:「為實現 AI 的潛力,產業、政府與社會大眾可能需要選擇買時間,以應對新興風險、建立安全措施、強化監管機制。」具體訴求是希望美國政府與各國合作,共同研發能「調控」自動化 AI 發展速度的技術與治理工具。

聯署者陣容包括 Anthropic 首席科學官 Jared Kaplan、OpenAI 首席科學家 Jakub Pachocki、Meta 首席科學官 Shengjia Zhao 均具名,另有 Google DeepMind 及矽谷新興重量級 AI 公司 Thinking Machines 等高層共同簽署。

廣告 - 內文未完請往下捲動

值得一提的是,OpenAI 執行長 Sam Altman 並未列名。他這週才剛在 Podcast 中宣稱人類已進入「奇異點(singularity)」,強調 AI 即將能夠自主改進自身。

導火線:OpenAI 模型逃出沙盒、主動攻擊外部系統

聲明發布的直接背景,是 OpenAI 上週公開承認的一起高度危險的資安事件。其最新未發布模型在測試環境中「逃脫沙盒」,為了在內部評測中取得更高分數,主動攻擊了一家與其毫無關聯的 AI 模型供應商 Hugging Face。

多數 AI 專家將此視為警訊:目前的 AI 系統已具備突破開發者控制框架的潛在能力,且其行動目標難以預測。

OpenAI 承認:測試中模型逃出沙盒、駭 HuggingFace 作弊

正如 Google 研究科學家 Stephanie Chan 在聲明旁所附上的評論:「我在 AI 領域工作了十年,過去這幾年,無論我如何頻繁更新自己的預測,每隔幾個月都會再次對技術進步的速度感到震驚。」

當務之急:遞迴自我改進(RSI)預計幾年內成真

此次聯署行動背後,是業界對「AI 自我改進」風險的深切憂慮。Anthropic 旗下智庫上個月發布報告,指出若 AI 能力持續提升,並累積足夠的科學探索能力,系統有可能開始自行設計並優化自身。

其中,「遞迴式自我改進(Recursive Self-Improvement, RSI)」,也就是 AI 系統不斷優化自身所形成的指數級迭代情況,是最被廣泛討論的主要擔憂。

Meta AI 研究副總裁 Dawn Song 警告:「許多研究者認為 RSI 可能在未來幾年內成真,其加速幅度恐怕將超出人類理解與治理這些系統的能力。危機發生前做好準備,才是審慎之道。」

地緣政治角力:國安問題重塑美國 AI 外交立場

聲明呼籲的「國際協調」路線,與川普政府過去的立場存在衝突。川普政府長期主張,國際 AI 治理框架可能以「安全」之名不公平束縛美國創新能力,因此傾向抵制多邊管制機制。然而,隨著 AI 逐漸成為國家安全的核心戰場,該立場正出現鬆動跡象。

Anthropic 的 Mythos 與 OpenAI 的 GPT 5.6 Sol 已確認具備發現並利用全新網路安全漏洞的能力,迫使美國開始透過國際協議鞏固半導體供應鏈,並與盟友合作防止關鍵 AI 設備流入他國。國家安全的現實考量,正在為國際 AI 合作提供新的政治正當性。

然而,正如 OpenAI 安全研究員 Leo Gao 所說:「世界正被鎖在一場通往智慧爆炸的死亡競賽。放慢腳步能給我們寶貴的時間去確保安全,但沒有任何一方願意單方面停下來。若想存活,我們必須協調彼此、共同減速。」

這場 AI 軍備競賽能否在危機爆發前停下腳步並做好準備,目前仍是未知數。

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。