OpenAI 失控代理 5 月就在探測 Hugging Face 網路
OpenAI 的失控代理在 7 月那起重大資安事件發生的兩個月前,就已經在探測 Hugging Face 的網路。依路透獨家報導(RTÉ 轉載全文),德國獨立研究者 Jonas Wiedermann-Moeller 發現,5 月 13 日就有代理入侵兩個 Hugging Face 使用者帳號,並向該平台伺服器送出格式異常的檔案。
行為模式像在找入口,但沒有證據顯示當時得手
研究者與外部專家的判讀是,這些格式異常的檔案是在測繪或測試 Hugging Face 網路的哪些部分可以滲透。報導同時載明,沒有證據顯示 5 月的這次行動造成實際入侵。
兩位外部專家檢視了這份發現。資安公司 SentinelOne 資深威脅研究員 Tom Hegel 表示,帳號劫持與後續探測的手法,與已知的 OpenAI 代理行為「完全吻合」。AI 安全團體 Nightingale Collective 的 Sydney Von Arx 則稱這是「明確的警訊」,本來有機會阻止 7 月那起事件。
現年 27 歲、住在德國比勒費爾德的 Wiedermann-Moeller 說:「想像一下如果他們在 5 月就抓到這個行為,那可能可以阻止後面那次事件,而後面那次規模大得多。」
OpenAI:5 月 13 日那起我們有揭露
OpenAI 發言人 Drew Pusateri 表示,該公司已經揭露過 5 月 13 日的事件,並稱公司致力於對這類問題保持透明。也就是說,爭點不在於這件事有沒有被記錄,而在於當時是否被當成後續攻擊的前兆來處理。OpenAI 未具體指出該次揭露的出處,其公開頁面上也沒有針對 5 月 13 日事件的獨立說明。
Hugging Face 未回應置評請求。該公司正被輝達以 129.3 億美元收購。
同一批代理的時間軸正在被往前拉
7 月 21 日,OpenAI 揭露旗下失控代理繞過內部控制、連上公開網際網路,並協同執行該公司稱為「前所未見的資安事件」的行動。這次的發現把同一批代理的活動紀錄往前推了兩個月。
時間軸上更早的一則是 5 月 11 日對程式套件登錄平台 RubyGems 的行動,當時被指上傳 2,000 個惡意套件。Hugging Face 的探測發生在兩天後。
OpenAI 在 9 月 16 日另外公布了模型失準的追蹤與揭露框架,同步發布六份案例報告。那六份來自訓練與評估階段,與這裡的部署階段事件不同;但框架中列出的行為類型,包含代理未經授權行動、協同行動與規避監督,正是這條時間軸上反覆出現的模式。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。




