人工智能公司Anthropic宣布推出其最新AI模型Claude Opus 5.5,這是全新Claude 5.5系列的首款產品。該模型在性能上達到頂級水平,但在運行成本上較前代模型大幅降低,旨在提供更高效、安全且易於協作的AI工具。
Opus 5.5在發布前經過多家外部機構的嚴格安全評估,並在編碼、知識工作及溝通能力上展現顯著進步,同時其定價也更具競爭力。
- 模型定位:Claude 5.5系列首款模型,在多數工作上性能媲美Claude Fable 5.1。
- 成本效益:運行成本比Opus 5低40%,生成速度快30%以上。
- 核心能力:在編碼、計算機使用和知識工作等基準測試中表現領先。
- 安全性能:在自動化行為審計中取得歷史最高分,並能更有效抵抗提示注入攻擊。
- 溝通優化:寫作風格更自然清晰,將重要資訊前置,提升人機協作體驗。
性能與成本效益躍升
Claude Opus 5.5在效率方面實現了重大突破。Anthropic表示,在典型工作負載下,其成本比Opus 5降低了40%。具體而言,輸入和輸出代幣價格分別為每百萬4美元和20美元,比Opus 5低20%;而佔據代理和編碼工作大部分成本的緩存讀取,價格更是降低了60%。除了成本優勢,Opus 5.5的生成速度也比前代快了30%以上,為用戶帶來更流暢的體驗。
編碼與知識工作能力增強
新模型在處理複雜和長期任務方面表現出色,尤其是在編碼領域。據早期測試者反饋,Opus 5.5能在不到一天內完成原需數週工程團隊才能處理的68萬行代碼遷移工作。在另一項內部測試中,Opus 5.5僅用9.5小時就將HAProxy軟件從C語言重寫為Rust,比Fable 5.1快了2.5小時,成本低51%。
在知識工作方面,Opus 5.5同樣展現了其作為可靠研究員的能力。在一項財務分析測試中,投資公司Walleye Capital報告稱,Opus 5.5不僅解決了評估套件中的問題,甚至發現並糾正了評估說明中連人類都未曾發現的錯誤。
強調安全與放緩發展
此次發布正值Anthropic首席執行官Dario Amodei呼籲「放緩人工智能進展」之際,旨在確保安全實踐能跟上模型能力的發展步伐。Opus 5.5在發布前接受了Frontier Design和METR等外部機構的評估,並配備了最高級別的安全防護措施。
該模型在公司的自動化行為審計中獲得了迄今為止所有模型中的最高分,顯示其採取不可逆轉行動或越界的可能性顯著降低。Anthropic強調,公司正致力於為當前和未來的AI模型開發更完善的安全實踐,以應對能力增強可能帶來的潛在風險。
來源:anthropic.com
封面來源:Adobe Stock

