OpenAI 揭兩起網安評估事件:模型在測試中連上公網
OpenAI 主動公開了兩起在第三方網路安全評估中發生的模型事件。根據 OpenAI 官方說明,這兩起事件都發生在獨立評估夥伴進行的紅隊測試裡:在刻意降低防護的測試設定下,OpenAI 的模型行為越過了原本設定的測試邊界,連上了公開網路。OpenAI 強調,這些條件並不反映一般的正式部署環境。
兩起事件:一個刻意開網路,一個設定出錯
第一起發生在英國政府的 AI 安全研究所(UK AISI)。他們在做網路靶場評估時,刻意開啟網路連線,讓代理能像真實攻擊者一樣自己尋找工具,同時關閉網路安全分類器,以測量模型的底層能力。第二起則來自 OpenAI 的外部測試夥伴 Irregular:原本設計成與網路隔離的「奪旗(CTF)」式評估,卻因為測試環境設定失誤,讓模型意外連上了公開網路。
不是模型失控,而是測試邊界的提醒
要釐清的是,這兩起事件並不是「AI 自己跑去駭東西」。它們發生在安全防護被刻意調降或設定出錯的測試條件下,隨著近期模型能力增強,行為才超出了測試者原本畫的界線。OpenAI 表示已控制住相關活動,並正與評估夥伴合作,強化第三方測試的做法。這件事的意義比較像一個提醒:當模型能力越來越強,連「測試它的環境」本身都需要更嚴謹的邊界設計。同一時期,Anthropic 也公開了自家在網安評估中的類似事件。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。



