Mistral 開源 Shieldstral:3B 多模態內容審核模型

Elponcrab
分享
Mistral 開源 Shieldstral:3B 多模態內容審核模型

法國 AI 公司 Mistral 開源了一個專門「把關內容」的小模型。根據 Mistral 官方公告,Shieldstral 是一個 30 億參數、採 Apache 2.0 授權的開源多模態安全分類器,主打內容審核,而且只需要一張 16GB 的 NVIDIA 顯卡就能運行。

把審核變成一道「是非題」,政策可即時替換

Shieldstral 的設計和傳統內容防護模型不同。傳統模型通常內建固定的分類標準,Shieldstral 則把審核變成一道二元的問答題:你用自然語言把政策當成問題丟給它,它針對「這段內容(文字、圖片或兩者)是否違反」給出一個校準過的「是/否」機率,一次前向推論就完成。最大的好處是政策可以在推論時自由替換、重新設定,不必為了改規則就重新訓練模型。

3B 打贏體積 7 倍大的同類模型

效能上,Mistral 稱 Shieldstral 在文字安全、拒答偵測、政策適應與多模態等基準上,可以匹敵甚至超越體積大它 7 倍的開源防護模型。它的權重已放上 Hugging Face,也是「開放安全 AI 聯盟(Open Secure AI Alliance)」的創始成員之一,這個由 NVIDIA 等發起的聯盟先前也收錄過 NVIDIA 的開源代理框架。對想自建內容審核、又不想把資料送上雲端的團隊來說,這是一個小而實用的選項。

廣告 - 內文未完請往下捲動

風險提示

加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。