Anthropic 阻斷飯店網路劫持、中國實驗室非法蒸餾 Claude 模型

DW
分享
Anthropic 阻斷飯店網路劫持、中國實驗室非法蒸餾 Claude 模型

路透社報導,Anthropic 最新網路威脅情報顯示,該公司在過去八個月內成功阻絕多起濫用 Claude 模型的惡意行為。攻擊者的技術應用已從單純問答轉向多智慧體架構,能自主執行多項攻擊指令,讓人類成為監督角色,行動涉及疑似與俄羅斯相關的網路間諜活動,以及非法蒸餾 Claude 模型功能。

中國實驗室非法蒸餾 Claude 模型 

Anthropic 發現七家中國實驗室嘗試蒸餾 Claude 模型功能,以降低訓練自有 AI 工具的成本。其中包含阿里巴巴發動的非法蒸餾行動,在數個月內透過數千個異常帳戶發起逾億次交易,試圖改進其 Qwen 模型。此外,Moonshot 與 DeepSeek 被指控將含敏感資訊的即時用戶對話路由至 Claude,試圖收集回應作為訓練資料。

國家級網路滲透自動化攻擊

惡意組織展現高度自動化的攻擊能力,一家與俄羅斯「Midnight Blizzard」特徵吻合的團體,利用 AI 在各個階段支援針對烏克蘭政軍機構與外交目標的魚叉式網路釣魚及飯店內 Wi-Fi 劫持行動,該組織建立能夠自動檢測惡意軟體是否被安全防禦系統標記的機制,並即時重寫程式碼以持續規避偵測。

廣告 - 內文未完請往下捲動

開發軍事軟體風險

威脅者嘗試利用 Claude 進行實體武器軟體開發,範圍涵蓋槍枝、飛彈與武裝無人機等控制系統,來自不同地區的操作者試圖運用該平台協助武器研發與情報收集,伴隨模型運算與分析能力提升,此類技術被誤用的風險大幅增加,促使安全團隊加大對非法運用的監測與干擾力度。

本文重點摘要筆記

  • AI 威脅自動化:攻擊者不再僅用 AI 輔助問答與文書處理,採用多智慧體架構執行自動化網路攻擊,人類則成為監督角色。
  • 未授權蒸餾 Claude:多家機構嘗試透過批量查詢或路由敏感對話來擷取 Claude 的輸出資料,以降低自研 AI 模型的訓練成本。
  • 自動化防禦規避:國家級威脅組織運用 AI 偵測惡意軟體是否被防護系統發現,並能即時自動重寫程式碼以成功避開防禦。
  • 軍事武裝軟體風險:威脅者利用高階模型進行飛彈、無人機與各類常規武器的軟體設計與情報收集。

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。