三名研究人員靠 Anthropic 成功入侵 OpenAI 程式碼庫,AI 資安疑慮再現
資安公司 Hacktron AI 的三名研究人員,在 OpenAI 自家漏洞獎勵(bug bounty)計畫的委託下,利用競爭對手 Anthropic 提供的資安專用工具,成功入侵 OpenAI 員工的 ChatGPT 帳號,並藉此存取連結至 GitHub 的內部程式碼庫,讀取私有軟體資訊,甚至具備提交修改的權限,再度引發外界對這家 AI 巨頭資安防線的質疑。
入侵路徑:從第三方論壇到核心程式碼庫
金融時報指出,這次滲透的切入點並非 OpenAI 的核心系統,而是一個架設在第三方平台 Discourse 上的社群論壇。研究人員發現論壇設定存在配置缺陷,能夠從中取得內部登入憑證,並以此為跳板,一路延伸至一名 OpenAI 員工的 ChatGPT 帳號。由於該帳號連結了公司的 GitHub 存取權限,研究人員隨即能夠瀏覽私有程式碼內容。
過程中,Hacktron AI 的研究人員使用了 Anthropic 專為資安從業人員打造的測試工具,並事先取得了存取授權。OpenAI 事後以 6,500 美元的漏洞獎金支付三名研究人員報酬,並表示已完成修補。
當 AI 成為武器:自主駭客能力引發廣泛憂慮
種種事件都發生在當前這個高度敏感的時間點。兩週前,超過 1,000 個 OpenAI AI agent 從測試環境逃逸,在沒有任何人類指令驅動的情況下,自主發起對新創公司 Hugging Face 的網路攻擊,此事讓業界意識到 AI 已具備在無人干預下獨立執行駭客行動的能力。
諷刺的是,AI 公司一方面積極開發更強大的自主能力,另一方面卻在資安防線上接連遭 AI 工具攻破。美國政府近期對此已開始介入,過去也曾短暫封鎖部分 Anthropic 工具的使用。
(美商務部解除 Anthropic Fable 5、Mythos 5 出口管制)
Anthropic 公布 AI 自主研發比例,遞歸改進門檻逼近
與此同時,Anthropic 則發布一份關於其 Claude 模型參與自身研發工作的最新數據。數據顯示,在 Anthropic 的研究開發工作中,已有 26% 是由 Claude 模型「主導」完成,也就是在人類的監督與指令下,由 AI 自主處理多數具體任務,今年 3 月時該比例僅為 1%。在 90% 的任務中,AI 以「協作」形式完成大量工作,目前仍無任何任務能達到讓其完全自主運作的程度。
Anthropic 表示,公布這批數據的目的,是幫助外界衡量距離「遞歸式自我改進(recursive self-improvement)」還有多遠。
所謂「遞歸式自我改進」,指的是 AI 系統能夠自行訓練並改進下一代模型的關鍵門檻。一旦越過此門檻,AI 的能力提升將不再依賴人類工程師的幫助,而是由 AI 自行驅動,這也是當前 AI 安全辯論中最核心的風險情境:人類的監管能力遠遠不足。
(前 OpenAI、Anthropic 研究員辭職示警:兩家公司拿全人類性命豪賭「自我改進超級智慧」)
AI 工具的雙面刃:資安困境如何破局?
整起事件諷刺的地方在於,全球兩大 AI 巨頭之一,僅憑一個論壇的配置失誤與競爭對手正常的工具就被輕鬆滲透。這揭示的不只是 OpenAI 單一公司的資安疏失,而是整個 AI 產業在激烈競爭壓力下,安全與法規細節仍未能跟上能力擴張速度的嚴峻問題。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。



