Anthropic 本周將其 AI 模型 Claude Mythos 加入安全防護,成為 Fable 5,並將強大能力推向大眾。
4 月份推出 Mythos Preview 時,Anthropic 只透過 Project Glasswing 提供給大約 50 家安全廠商及研究機構,因為擔心它尋找軟體漏洞的能力太強大,可能會被誤用。為此,它必須為模型加入安全防護,也就成了 Fable 5 。
Fable 5 在多項測試中皆為 Anthropic 歷來最強大,尤其在軟工、知識工作、視覺任務的表現,不但超越 Claude Mythos Preview,也超過 OpenAI GPT 5.5 及 Google Gemini 3.1 。但是為確保其安全性,Anthropic 加入了防護機制,像是拒絕某些領域的問題,而在高風險領域如網路安全、生物及化學上,會使用第二強的模型 Claude Opus 4.8 來回答。 Anthropic 說,初期 Fable 5 可能會誤判導致拒絕回答問題,但比例應該會小於 5%,且未來隨著模型上路,誤判情形應該會再減少。
Anthropic 昨天也推出 Mythos 5 作為 Preview 的升級版。 Mythos 5 和 Fable 5 的基礎模型是相同的,差別在於 Mythos 拿掉了限制。上週 Anthropic 將對象擴充到 15 個國家的基礎架構管理商。該公司也承諾會再進一步擴大 Mythos 的測試對象,包括生物研究人員。
現在 Fable 5 已透過 Anthropic Claude API 和用量計價 Enterprise 方案正式提供客戶使用。 Fable 5/Mythos 5 使用價格上,輸入與輸出收費為每百萬 Token 10 美元與 50 美元,比 Claude Mythos Preview 降價超過 50%,但是 Claude Opus 4.8 的 2 倍。
6 月 22 日前 Pro 、 Max 、 Team 和席次計價 Enterprise 方案客戶可不額外付費使用 Fable 5 。從 6 月 23 日起,Anthropic 將把 Fable 5 從這些方案移除,因為未來要支付 credit 費用才能使用,但 Anthropic 說規劃會及早將之納入標準訂閱方案中。
該公司在發布前針對 Fable 5 進行測試,在 1,000 多小時測試中,不論是內部人員或外部紅隊演練團隊皆未找到一個保證越獄的方法。但是推出之初,Anthropic 會要求所有流量保留 30 天,但其理由不是用這些資料來訓練模型,而是用來防禦新式攻擊,包括新的越獄手法,以及辨識及減少誤判情形。
來源:Techcrunch
