馬斯克:AI 現在非常危險,應該讓模型間彼此進行安全測試

Neo
分享
馬斯克:AI 現在非常危險,應該讓模型間彼此進行安全測試

Elon Musk 在 All-In Summit 表示,到了現在這個階段 AI 顯然非常危險,而且隨著模型能力持續提升,AI 風險正在呈現指數式增加。他也進一步解釋,自己日前為何罕見公開表示 Anthropic 執行長 Dario Amodei「是對的」。

但 Musk 支持的並不是立即建立一套龐大的全球 AI 監管機構,而是一種更直接的業界互審制度:讓 OpenAI、Anthropic、xAI、Google、Meta,甚至中國主要 AI 公司,在模型正式發布前彼此進行安全測試。

廣告 - 內文未完請往下捲動

Musk:AI 模型正變得危險,而且風險持續上升

Musk 在對談中首先談到近期 AI Agent 與資安事件。他表示,近期發生的事件已經顯示,足夠聰明的 AI 模型可能會嘗試突破原本施加在它身上的限制。Musk 警告:「到了現在這個階段,AI 的危險已經非常顯著,我們需要在 AI 安全上做得更好。」

他進一步表示,目前 AI 模型帶來的風險正在「指數式增加」。Musk 強調,這並不是只有 Dario Amodei 一個人的擔憂。他表示,自己也從許多 Anthropic 員工那裡聽到類似警告,而 Anthropic 內部甚至有人公開表示,他們自己的模型已經讓人感到害怕。

在 Musk 看來,如果連最了解這些模型的開發者都不斷警告模型正在變得危險,那麼外界應該認真看待這些訊號。他說:「當 Anthropic 很多人、OpenAI 也有人告訴你,他們的模型非常危險時,我認為我們應該相信他們。」

為何說「Dario 是對的」?Musk:AI 安全確實需要加強

Musk 日前曾在社群平台公開表示「Dario is right」,一度被外界解讀為他全面支持 Anthropic 放慢 AI 競賽與強化監管。他在這次對談中則進一步澄清,自己當時應該說得更完整。他表示,自己真正認同的是 AI 風險已經變得相當嚴重,以及 AI 安全必須進一步提升,而不是單純全面支持某一套監管方案。

Musk 甚至半開玩笑地指出,AI 公司一方面告訴外界,自己的模型可能有一定機率導致人類滅亡,另一方面又同時向投資人募資,這本身就是一種相當奇特的矛盾。

不過當主持人進一步追問「AI 到底如何從駭客工具一路走到毀滅人類」時,Musk 提出的其中一個風險情境,是 AI 最終可能取得軍事系統的控制權。

主持人反駁,許多軍事系統本身都是 air-gapped、沒有直接連上網路;Musk 則回應,這些系統仍然需要更新軟體,而惡意程式仍可能透過 USB 等方式跨越實體隔離。

Musk 提議:不要讓 AI 公司「自己改自己的考卷」

相較於直接建立新的全球監管機構,Musk 目前最支持的方案,是要求大型 AI 公司彼此測試對方的模型。現在各家 AI 公司主要都是自己替自己的模型做安全測試,等於「自己改自己的考卷」。

Musk 認為,OpenAI 的安全測試工具不應只測 OpenAI 自己的模型;Anthropic、xAI、Google、Meta 等公司,也都應該把自己的測試方法拿來測試其他公司的模型。

他表示:「我認為最明智的做法,就是讓主要 AI 競爭者彼此測試對方的模型。」

這套制度的核心,是在模型正式推出以前,就提供其他主要 AI 公司一定程度的 API 存取權,讓競爭對手測試模型是否具有危險能力,例如製造生物武器、核武器、進行欺騙,或採取其他高風險行為。

如果其他公司發現問題,開發者就必須先處理;如果開發者拒絕修正,測試公司則可以公開表示該模型存在安全風險。

把中國也拉進來:Musk 反對只有美國自己綁手綁腳

Musk 特別強調,任何真正可行的 AI 安全制度,都必須是中國也願意接受的制度。否則如果只有美國公司受到限制,而中國模型持續快速發展,最終只會變成美國「自己把自己綁住」,並把 AI 領先位置讓給中國。

他表示:「這必須是中國也願意接受的東西,否則我們只是在削弱自己,最後中國會贏。」

也因此,相較於要求中國接受一個由美國或西方主導的 AI 監管機構,Musk 認為「模型發布前互相測試」反而更實際。因為這不需要中國接受美國監管機構直接進入中國 AI 公司,也不要求任何一方停止模型訓練,只需要各家公司讓彼此進行模型測試。Musk 認為,這甚至可能成為美中之間少數有機會快速達成共識的 AI 安全措施。

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。