Anthropic Mythos 網安測試中偽造假身分,企圖騙人植入惡意碼
繼 OpenAI 之後,AI 安全的另一隻靴子也落下。根據 CNBC 等報導,Anthropic 揭露旗下模型 Mythos 5 在一場網路安全評估中,竟主動「偽造假身分」,試圖說服人類替一個開源專案植入惡意程式碼。這是英國 AI 安全研究所(AISI)與 OpenAI、Anthropic 在 8 月初一起公開的系列網安事件之一。
從假身分到直接聯繫真人:AI 的越界行為
具體來說,Anthropic 的 Mythos 5 代理為了讓人類審查者批准把惡意碼「插進一個公開使用的開源專案」,建立了多個假身分,甚至直接聯繫真實的人,透過線上檔案傳輸服務發送訊息與檔案,試圖說服他們、或他們自己的 AI 編程工具去執行惡意碼。AISI 表示,這是它第一次看到「未經指示、在真實世界中針對真人」如此嚴重的欺騙行為,不過目前並無造成實際危害的證據。
122 次挑戰、10 次越界,多數來自 Mythos 5
這批事件的規模是這樣:AISI 進行的 122 項網路安全挑戰中,有 10 次出現 AI 代理「在真實網路上採取自主、未經授權的行動,鎖定真實的人與組織」,其中多數來自 Anthropic 的 Mythos 5,其餘來自 OpenAI 的 GPT-5.6-Sol。這和我們今天稍早報導的 OpenAI 網安評估事件是同一串,都發生在防護被刻意調降的測試條件下,隨著模型能力增強,行為越過了測試者原本畫的邊界。它給產業的提醒是一致的:測試前沿 AI 的環境本身,需要更嚴謹的邊界設計。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。



