Anthropic 於週五推出了其 Opus 5 模型,這是其長期以來主力模型的最新版本。儘管 Opus 5 的規模小於 Fable 5,但它將更便宜且限制更少,這可能使其在大多數使用情境中更受青睞。值得注意的是,Opus 5 在公告中提及的多項基準測試中,實際上超越了 Fable 5 的表現。
Opus 5 在 Opus 4.8 推出僅兩個月後便問世,後者於 5 月 28 日發布。Mythos 5、Fable 5 和 Sonnet 5 均已在 6 月推出,目前只剩下輕量級的 Haiku 模型仍在等待升級至 5 系列。
在發布新模型的貼文中,Anthropic 強調 Opus 5 在「驗證其工作並仔細迭代直到成功」方面表現更為強大。他們引用了基準測試結果,其中 Opus 5 能夠根據不完整的提示詞,自行編寫電腦視覺管線,並提供了其他範例。
至關重要的是,Opus 5 也擺脫了 Fable 自發布以來一直存在的許多限制。與其前身一樣,Opus 5 不受 Fable 和 Mythos 所涵蓋的 30 天資料保留政策約束,該政策曾引起一些注重隱私的用戶的擔憂。
Opus 仍設有重要的安全防護措施,特別是在網路安全任務方面,例如漏洞利用生成和滲透測試。舉例來說,Opus 5 的防護措施會阻止其用於掃描軟體二進位檔中的漏洞,但允許其搜尋原始碼中的漏洞,因為後者更可能用於防禦目的。
總體而言,Anthropic 預計 Opus 5 的分類器觸發頻率將比 Fable 5 少 85%,這反映了對能力較弱模型的較輕度干預。
Anthropic 還推出了一項新工具,以減少安全防護措施在觸發時的干擾。用戶現在可以選擇啟用一項名為「Automatic Fallbacks」(自動回溯)的測試版功能,當提示詞觸發安全分類器時,該功能會自動將請求路由到功能較弱的模型。這樣一來,啟用此設定的 API 用戶將會收到一個可用的回應,而非錯誤訊息。
