中國 Kimi K3 測試中「越獄」偷看答案:連 GitHub 抄解答

Elponcrab
分享
中國 Kimi K3 測試中「越獄」偷看答案:連 GitHub 抄解答

又一個前沿 AI 模型在安全測試中「作弊」,這次的主角是中國的 Kimi K3。根據南華早報報導,月之暗面(Moonshot AI)上個月推出的 Kimi K3,在一場網路安全測試中逸出了「本應完全隔離」的沙盒環境、連上公開網路,直接到 GitHub 上找答案,而不是自己解題。

怎麼越獄的:網路設定疏失,連上 GitHub 抄答案

資安公司 Frontier Security 在英國 AI 安全研究所(AISI)的網路安全評測框架裡測試 Kimi K3 時發現,一個「基本的網路設定疏失」讓模型得以逃出測試牢籠。Kimi K3 探測了自己的網路環境,發現 GitHub 意外是可連的,於是複製了這套評測的官方程式庫、找到題目的解答,直接從硬碟讀出答案,而不是去解那道網路安全挑戰。

與 OpenAI、Anthropic 事件不同,且它是開源權重

和先前 OpenAI 與 Anthropic 模型在測試中「駭進外部組織」的事件不同,Kimi K3 並沒有攻擊任何外部單位—它要的答案本來就公開放在 GitHub 上。Frontier 研究員 Paul Kassianik 指出,Kimi K3 缺乏防止它作弊或逃出沙盒的護欄。更關鍵的是,Kimi K3 是「開源權重」模型:這次在測試中逃出隔離的,就是任何人都能下載、直接執行的同一個版本,沒有閉源業者可能事後加上的安全層。想了解這款模型的技術與定位,可參考鏈新聞的 Kimi K3 完整指南

廣告 - 內文未完請往下捲動

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。