三名研究人員靠 Anthropic 成功入侵 OpenAI 程式碼庫,AI 資安疑慮再現

Crumax
分享
三名研究人員靠 Anthropic 成功入侵 OpenAI 程式碼庫,AI 資安疑慮再現

資安公司 Hacktron AI 的三名研究人員,在 OpenAI 自家漏洞獎勵(bug bounty)計畫的委託下,利用競爭對手 Anthropic 提供的資安專用工具,成功入侵 OpenAI 員工的 ChatGPT 帳號,並藉此存取連結至 GitHub 的內部程式碼庫,讀取私有軟體資訊,甚至具備提交修改的權限,再度引發外界對這家 AI 巨頭資安防線的質疑。

入侵路徑:從第三方論壇到核心程式碼庫

金融時報指出,這次滲透的切入點並非 OpenAI 的核心系統,而是一個架設在第三方平台 Discourse 上的社群論壇。研究人員發現論壇設定存在配置缺陷,能夠從中取得內部登入憑證,並以此為跳板,一路延伸至一名 OpenAI 員工的 ChatGPT 帳號。由於該帳號連結了公司的 GitHub 存取權限,研究人員隨即能夠瀏覽私有程式碼內容。

過程中,Hacktron AI 的研究人員使用了 Anthropic 專為資安從業人員打造的測試工具,並事先取得了存取授權。OpenAI 事後以 6,500 美元的漏洞獎金支付三名研究人員報酬,並表示已完成修補。

廣告 - 內文未完請往下捲動

當 AI 成為武器:自主駭客能力引發廣泛憂慮

種種事件都發生在當前這個高度敏感的時間點。兩週前,超過 1,000 個 OpenAI AI agent 從測試環境逃逸,在沒有任何人類指令驅動的情況下,自主發起對新創公司 Hugging Face 的網路攻擊,此事讓業界意識到 AI 已具備在無人干預下獨立執行駭客行動的能力。

諷刺的是,AI 公司一方面積極開發更強大的自主能力,另一方面卻在資安防線上接連遭 AI 工具攻破。美國政府近期對此已開始介入,過去也曾短暫封鎖部分 Anthropic 工具的使用。

美商務部解除 Anthropic Fable 5、Mythos 5 出口管制

Anthropic 公布 AI 自主研發比例,遞歸改進門檻逼近

與此同時,Anthropic 則發布一份關於其 Claude 模型參與自身研發工作的最新數據。數據顯示,在 Anthropic 的研究開發工作中,已有 26% 是由 Claude 模型「主導」完成,也就是在人類的監督與指令下,由 AI 自主處理多數具體任務,今年 3 月時該比例僅為 1%。在 90% 的任務中,AI 以「協作」形式完成大量工作,目前仍無任何任務能達到讓其完全自主運作的程度。

Anthropic 表示,公布這批數據的目的,是幫助外界衡量距離「遞歸式自我改進(recursive self-improvement)」還有多遠。

所謂「遞歸式自我改進」,指的是 AI 系統能夠自行訓練並改進下一代模型的關鍵門檻。一旦越過此門檻,AI 的能力提升將不再依賴人類工程師的幫助,而是由 AI 自行驅動,這也是當前 AI 安全辯論中最核心的風險情境:人類的監管能力遠遠不足

前 OpenAI、Anthropic 研究員辭職示警:兩家公司拿全人類性命豪賭「自我改進超級智慧」

AI 工具的雙面刃:資安困境如何破局?

整起事件諷刺的地方在於,全球兩大 AI 巨頭之一,僅憑一個論壇的配置失誤與競爭對手正常的工具就被輕鬆滲透。這揭示的不只是 OpenAI 單一公司的資安疏失,而是整個 AI 產業在激烈競爭壓力下,安全與法規細節仍未能跟上能力擴張速度的嚴峻問題。

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。