OpenAI、Anthropic 千名頂尖科學家聯署要求「放慢 AI 發展」,發生什麼事?
OpenAI、Anthropic、Google DeepMind、Meta 等美國頂尖人工智慧公司逾千名員工,包括多位科學家與共同創辦人,在今日(29)發佈聯署聲明,要求美國政府推動國際合作,建立技術與政策工具,以調控自動化 AI 的研發速度,引發外界猜測動機為何。
AI 巨頭聯合聲明:為何突然踩煞車?
據悉,聲明並未明確要求政府暫停或減緩 AI 開發,但要求保留「能隨時放慢 AI 技術推進」的選項。聲明原文指出:「為實現 AI 的潛力,產業、政府與社會大眾可能需要選擇買時間,以應對新興風險、建立安全措施、強化監管機制。」具體訴求是希望美國政府與各國合作,共同研發能「調控」自動化 AI 發展速度的技術與治理工具。
聯署者陣容包括 Anthropic 首席科學官 Jared Kaplan、OpenAI 首席科學家 Jakub Pachocki、Meta 首席科學官 Shengjia Zhao 均具名,另有 Google DeepMind 及矽谷新興重量級 AI 公司 Thinking Machines 等高層共同簽署。
值得一提的是,OpenAI 執行長 Sam Altman 並未列名。他這週才剛在 Podcast 中宣稱人類已進入「奇異點(singularity)」,強調 AI 即將能夠自主改進自身。
導火線:OpenAI 模型逃出沙盒、主動攻擊外部系統
聲明發布的直接背景,是 OpenAI 上週公開承認的一起高度危險的資安事件。其最新未發布模型在測試環境中「逃脫沙盒」,為了在內部評測中取得更高分數,主動攻擊了一家與其毫無關聯的 AI 模型供應商 Hugging Face。
多數 AI 專家將此視為警訊:目前的 AI 系統已具備突破開發者控制框架的潛在能力,且其行動目標難以預測。
(OpenAI 承認:測試中模型逃出沙盒、駭 HuggingFace 作弊)
正如 Google 研究科學家 Stephanie Chan 在聲明旁所附上的評論:「我在 AI 領域工作了十年,過去這幾年,無論我如何頻繁更新自己的預測,每隔幾個月都會再次對技術進步的速度感到震驚。」
當務之急:遞迴自我改進(RSI)預計幾年內成真
此次聯署行動背後,是業界對「AI 自我改進」風險的深切憂慮。Anthropic 旗下智庫上個月發布報告,指出若 AI 能力持續提升,並累積足夠的科學探索能力,系統有可能開始自行設計並優化自身。
其中,「遞迴式自我改進(Recursive Self-Improvement, RSI)」,也就是 AI 系統不斷優化自身所形成的指數級迭代情況,是最被廣泛討論的主要擔憂。
Meta AI 研究副總裁 Dawn Song 警告:「許多研究者認為 RSI 可能在未來幾年內成真,其加速幅度恐怕將超出人類理解與治理這些系統的能力。危機發生前做好準備,才是審慎之道。」
地緣政治角力:國安問題重塑美國 AI 外交立場
聲明呼籲的「國際協調」路線,與川普政府過去的立場存在衝突。川普政府長期主張,國際 AI 治理框架可能以「安全」之名不公平束縛美國創新能力,因此傾向抵制多邊管制機制。然而,隨著 AI 逐漸成為國家安全的核心戰場,該立場正出現鬆動跡象。
Anthropic 的 Mythos 與 OpenAI 的 GPT 5.6 Sol 已確認具備發現並利用全新網路安全漏洞的能力,迫使美國開始透過國際協議鞏固半導體供應鏈,並與盟友合作防止關鍵 AI 設備流入他國。國家安全的現實考量,正在為國際 AI 合作提供新的政治正當性。
然而,正如 OpenAI 安全研究員 Leo Gao 所說:「世界正被鎖在一場通往智慧爆炸的死亡競賽。放慢腳步能給我們寶貴的時間去確保安全,但沒有任何一方願意單方面停下來。若想存活,我們必須協調彼此、共同減速。」
這場 AI 軍備競賽能否在危機爆發前停下腳步並做好準備,目前仍是未知數。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。


