新聞 2 / 12

產品發佈

Anthropic 推出 Opus 5.5,價格降低且具備 Fable 級別效能

Anthropic releases Opus 5.5 with lower prices and Fable-level performance

Anthropic 推出 Opus 5.5,價格降低且具備 Fable 級別效能

www.anthropic.com · 2026-09-22

摘要

Anthropic 發布了新一代模型 Opus 5.5,宣稱這是該公司測試過表現最強的模型,並提供與 Fable 級別相當的效能。此次更新同時降低了價格,顯示 Anthropic 在提升模型能力的同時,也致力於降低使用成本。

Anthropic 發布 Opus 5.5:效能達 Fable 等級,成本大幅降低

Anthropic 於 2026 年 9 月 22 日推出新一代語言模型 Claude Opus 5.5,是全新 Claude 5.5 系列的第一款產品。官方表示,這款模型在多數任務上的表現已經達到 Claude Fable 5.1 的水準,運行成本卻比前代 Opus 5 低 40%。這也是 Anthropic 先前提出「前沿技術發展應適度放緩」之後,第一次發布新模型。

效能突破與具體應用案例

Anthropic 表示 Opus 5.5 是公司目前測試過表現最強的模型。早期測試中,這款模型在複雜任務上有明顯進步。舉例來說,有測試者用 Opus 5.5 在不到一天內完成了 68 萬行程式碼的遷移工作,換成工程團隊執行則需要數週時間。在軟體效率優化的測試裡,被要求縮減網頁應用程式所有頁面的載入時間時,Opus 5.5 在 40 次測試中有 39 次達成目標;相較之下,Opus 5 只能做出幅度較小、且可能改變應用程式行為的調整。另外,在由單一提示生成遊戲的測試中,Opus 5.5 在圖形強度與精緻度評分上超過其他所有模型。

在編程方面,Opus 5.5 特別擅長處理長篇且龐雜的任務。測試顯示,這款模型能在三小時內審計並修復一個 20 萬行程式碼的程式庫,而 Opus 5 得花超過 20 小時,用掉的 token 數量還多了 2.5 倍。在把 HAProxy 從 C 語言轉譯為 Rust 語言的內部測試中,Opus 5.5 只花 9.5 小時就完成,比 Fable 5.1 的 12 小時快,成本也降低 51%。在自動化編程基準測試 FrontierCode v1.1 中,Opus 5.5 以預設努力程度拿下 54.6% 的分數,高於 GPT-6 Astra 的 53.3%,而且每項任務的成本只有後者的五分之一左右。

安全性與對齊測試表現

安全性方面,Opus 5.5 在 Anthropic 目前最全面的自動化行為審核中拿下所有模型中的最佳分數。這項審核涵蓋近 2,000 個模擬場景,測試模型在各種情況下的對齊表現。Opus 5.5 比近期模型更不容易採取難以逆轉的行動,也更不容易偏離既定邊界,對提示注入攻擊的抵抗力也比 Opus 5 強。在 Gray Swan 進行的基準測試中,Opus 5.5 與 Fable 5.1 並列最低的提示注入成功率。

針對高風險領域,Anthropic 為 Opus 5.5 部署了與 Claude Fable 5.1 相似的防護措施。由於 Opus 5.5 在生物學和網路安全領域的能力已經跟 Claude Mythos 5.1 相當,網路安全相關任務大多會被重新導向到 Opus 4.8 處理,確保一般軟體開發流程不受影響,但仍允許用戶找出並修復程式碼中的錯誤。生物學研究方面,經過驗證的組織可以申請「生命科學驗證計劃」來使用這款模型。此外,Anthropic 即將擴大「網路驗證計劃」,讓經過驗證的網路安全從業者可以使用 Opus 5.5 進行工作。

成本結構與定價調整

Opus 5.5 的定價直接反映運算需求的降低。在典型負載下,成本比 Opus 5 低 40%。具體來看,輸入 token 價格為每百萬 4 美元(Opus 5 是 5 美元),輸出 token 為每百萬 20 美元(Opus 5 是 25 美元)。佔代理和編程工作成本大部分的快取讀取,價格降到每百萬 0.20 美元,比 Opus 5 低 60%。快取寫入價格則是每百萬 5 美元(Opus 5 是 6.25 美元)。

除了降價,Anthropic 也提高了 Pro、Max、Team 和基於席位的企業計劃的 Five-hour 使用限制。Opus 5.5 的輸出生成速度也比 Opus 5 快 30% 以上。在 Claude Code 和 Claude Platform 上,還提供「快速模式」,速度最高可提升 2.5 倍,但成本較高,輸入 token 為每百萬 8 美元,輸出 token 為每百萬 40 美元。

溝通能力與客戶反饋

Opus 5.5 在溝通自然度上做了不小的改進,目的是解決 Opus 5 常見被反映的問題。測試者發現它的寫作更清楚易懂,會把重要資訊放在前面,也減少了行話或獨特短語的使用。無論是解釋程式碼錯誤還是總結對話,Opus 5.5 的輸出都被認為更容易追蹤,是更好的長期工作夥伴。

多家企業客戶分享了使用經驗。GitHub 指出,這款模型在 VS Code 中解決終端任務所需的步驟,不到 Opus 5 的一半。Clio 的開發者表示,Opus 5.5 能在沒有人監督的情況下連續運行 18 小時以上,完成跨儲存庫的複雜工程任務,程式碼註釋也簡潔有用。Spotify 的工程師報告,Opus 5.5 在內部評估中大幅提高了 token 效率,能以更低成本、更快速度完成相同任務。Optiver 則發現,在代理編程任務中,這款模型只用約一半的回合數、時間和輸出 token,就達到 Opus 5 的品質水準。

未來發展與可用性

Anthropic 表示,Claude Sonnet 5.5 和 Claude Haiku 5.5 將在未來幾週內推出,也會包含許多相同的效能、效率和安全性改進。Claude Opus 5.5 目前已經可以在所有平台上使用,包括 Amazon Web Services、Google Cloud 和 Microsoft Azure。開發人員可以在 Claude Platform 上透過 claude-opus-5-5 開始使用。

數據保留方面,Opus 5.5 提供零數據保留選項,並配備水印措施以符合歐盟 AI 法案的要求。這款模型也不再提供關閉「思考」模式的選項。Anthropic 強調,儘管 Opus 5.5 在自動化行為審核中表現優異,但要建立能可靠捕捉所有部署前失敗的評估方式,仍是尚未解決的問題,因此持續強化安全實踐與未來模型的準備工作仍然重要。

開發者:可關注 Opus 5.5 的效能表現與 API 價格調整

投資人:Anthropic 的定價策略與模型競爭力值得留意

一般用戶:Anthropic 服務可能提供更高效且具成本效益的體驗

重要性評分

75/100

🟠 值得關注

AnthropicOpus 5.5AI 模型價格調整效能提升
原文出處
上一則OpenAI 推出 GPT-6 Sol 與 Luna 模型下一則GPT-6 提示詞快取效能優化:降低延遲與成本

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。

相關指南

🤖 本文摘要由 AI 自動生成,內容源自原始報導。如有疑慮,請參閱關於我們

喜歡這篇?每天早晨還有更多。

訂閱 5min AI,讓 AI 替你追蹤整個 AI 世界。