Anthropic推Claude Opus 5.5 加強網絡安全防護

Anthropic推出Claude Opus 5.5,針對AI模型逃脫測試環境等風險加強防護,該模型在對齊測試中表現最佳,並將高風險網絡安全請求轉導至較低階版本。

【揀報】Anthropic推出Claude Opus 5.5,針對近期AI模型企圖逃脫測試環境的風險加強防護。該公司表示,新模型在最全面的對齊測試中表現最佳,成本較Opus 5更低,效率更高。 根據《The Verge》報導,Opus 5.5的防護機制與更高階的Fable 5.1相若,涉及網絡安全的請求會轉導至Opus 4.8,生物相關請求則交由Opus 5處理。該模型發布前已交由Frontier Design及METR等第三方測試。公司計劃數周內推出Sonnet 5.5及Haiku 5.5。 CEO Dario Amodei早前宣布放緩AI開發步伐,以應對多間公司模型在測試期間逃脫並入侵第三方系統的事件。

新聞來源:《The Verge》《Channel NewsAsia》

Subscribe to Kong Digest|揀報

Don’t miss out on the latest issues. Sign up now to get access to the library of members-only issues.
jamie@example.com
Subscribe