OpenAI 親證 Astra 資安大躍進!AI 能自主「找漏洞、寫攻擊、執行」部分內部工作喊停
昨日我們才報導,OpenAI 下一代主要模型 Astra 傳出最快近期發布,且執行長 Sam Altman 親自表示,Astra 是一款「強大的模型」,OpenAI 希望最終能廣泛開放,而不是只讓少數人使用;不過,由於其網路攻防能力(cyber capabilities),公司仍需要更多時間處理安全問題。
(ChatGPT 6 要來了?國外爆料 OpenAI 下週釋出預訓練模型 Astra,奧特曼回應了)
如今 OpenAI 進一步公布 Astra 的初步資安評估,證實問題可能比單純「模型很會寫程式」更加敏感。
OpenAI 8 月 7 日發布〈Responding to the next frontier of critical cyber capabilities〉指出,過去幾天針對 Astra 進行的最新內部評估顯示,模型在「Agentic Coding」以及網路安全能力上取得顯著進展。
結合內部測試與專家評估後,OpenAI 在前一晚得出一項重要結論:按照公司的 Preparedness Framework(準備框架),目前已經「無法排除 Astra 具備 Critical 等級網路安全能力的可能性」。
Critical 有多強?可能自主找到 Zero-day 並完成攻擊
這裡的「Critical」並非單純形容 Astra 很會寫程式,而是 OpenAI Preparedness Framework 中非常具體的能力門檻。
按照 OpenAI 定義,如果模型能夠在沒有人工介入的情況下,針對大量經過強化防禦的真實世界關鍵系統,自主找出漏洞並開發出可實際運作、涵蓋各種嚴重程度的 Zero-day exploit。
或者使用者只需要提供一個高階目標,AI 就能自行構思並執行一套從頭到尾、全新的網路攻擊策略,就可能達到 Critical 門檻。
真正令人擔憂的並不是「Astra 可以教人怎麼駭客攻擊」,而是 AI 是否開始具備把「找漏洞 → 開發利用方式 → 規劃攻擊 → 執行」串成自主流程的能力。
OpenAI 強調,目前仍在進行基準測試,因此尚未正式認定 Astra 已經達到 Critical;比較精確的說法是,初步測試成績已經強到讓 OpenAI 無法排除這個可能性。
GPT-5.6 仍只有 High,Astra 可能首次跨過 Critical
這也凸顯 Astra 與 OpenAI 現有模型的差距。
OpenAI 特別在公告中點名,包括 GPT-5.6 Sol 在內的過去模型,都曾接受前沿網路安全能力測試,但最高僅被評估為 High,而不是 Critical。
如果後續測試確認 Astra 達到 Critical,代表 OpenAI 的模型可能首次跨越 Preparedness Framework 中這項重要資安門檻,也可以解釋為什麼 Altman 會表示,即使希望 Astra 能夠普遍開放,團隊仍需要更多時間確保安全。
OpenAI 暫停部分 Astra 內部工作
面對可能跨越 Critical 門檻的模型,OpenAI 已經開始採取實際措施,而不只是延後公開發布。
OpenAI 表示,公司正在提高高能力模型相關活動的安全標準,包括採用隔離測試環境、限制網路及工具存取、加強模型權重保護與加密、增加監控與偵測,以及使用 Sandbox 執行環境。
更值得注意的是,OpenAI 已經暫停目前尚未符合這些強化安全要求的 Astra 內部活動。
同時,所有使用 Astra 的 Agentic 應用,包括模型訓練與評估,都開始採用全面性的風險與 misalignment 監控。OpenAI 表示,監控系統甚至會評估模型的 Chain of Thought,在偵測到高風險行為時觸發安全程序,進一步人工審查或中斷相關活動。
Astra 還要接受美國政府與外部安全組織測試
OpenAI 接下來還計畫與相關政府機構以及特定 AI 安全組織合作,進一步測試 Astra 的能力;對於需要進行高風險測試的第三方合作夥伴,也會提供更嚴格的安全控制建議。
因此,昨天討論的另一個問題:Astra 是否可能因能力過強,而受到政府限制甚至無法全面向海外提供,目前仍沒有答案。
至少 OpenAI 現階段並沒有宣布 Astra 將受到出口限制,相反地,公司再次強調,希望具備先進 Cyber 能力的模型可以協助防禦者比攻擊者更早找到並修補漏洞,並希望 Astra 以及後續前沿模型最終能以負責任且廣泛的方式部署。
但 Astra 現在不只要通過 OpenAI 自己的安全測試,還將與政府機構合作進行能力評估,意味著它最後究竟能以什麼形式、向哪些使用者以及哪些地區開放,仍存在變數。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。



