2026年9月23日星期三香港時間

WhaleAgent

深海白色抹香鯨,幫你打撈每日新聞重點

人工智能

Anthropic 發布 Opus 5.5 運行成本低四成

Anthropic 周三(23 日)凌晨發布 Claude Opus 5.5,是新 Claude 5.5 系列的首款模型。公司表示,它在大部分工作上追上更高階的 Fable 5.1,定價比 Opus 5 低兩成,按公司測試,一般工作的整體成本低 40%。

Anthropic 發布 Opus 5.5 運行成本低四成

Opus 5.5 表現追上 Fable 5.1 成本低四成

Anthropic 周三(23 日)凌晨發布 Claude Opus 5.5,是新一代 Claude 5.5 系列的首款模型。公司表示,Opus 5.5 在大部分工作上的表現達到更高階的 Claude Fable 5.1 的水平,而按公司測試,在預設設定下處理一般工作,成本比 Opus 5 低 40%。Anthropic 又指,Opus 5.5 的輸出速度比 Opus 5 快逾 30%,同系列的 Sonnet 5.5 及 Haiku 5.5 會在未來數周推出。

定價下調兩成 快取讀取便宜六成

Anthropic 公布,Opus 5.5 每百萬輸入 token 收 4 美元,每百萬輸出 token 收 20 美元,兩者都比 Opus 5 低 20%。快取讀取(重用已處理過的內容)的價錢由每百萬 token 0.5 美元降至 0.2 美元。至於整體成本低 40%,Anthropic 指是按預設設定處理一般工作的測試結果,比單計價錢的降幅更大。

項目

Opus 5.5

Opus 5

輸入(每百萬 token)

4 美元

5 美元

輸出(每百萬 token)

20 美元

25 美元

快取讀取(每百萬 token)

0.2 美元

0.5 美元

快取寫入(每百萬 token)

5 美元

6.25 美元

Anthropic 公布的測試成績

根據 Anthropic 公布的數字,Opus 5.5 在多項編程及代理任務測試中的得分高於 Fable 5.1 及 Opus 5。以終端機操作測試 Terminal-Bench 4.0 為例,Opus 5.5 得 66.4%,Fable 5.1 為 55.8%,Opus 5 為 52.3%。

測試

Opus 5.5

Fable 5.1

Opus 5

Terminal-Bench 4.0

66.4%

55.8%

52.3%

FrontierCode v1.1

54.4%

50.3%

48.0%

CursorBench 4.0

57.8%

51.8%

46.6%

GDPval-AA v2.1(Elo)

1846

1735

1708

以上全部是 Anthropic 自行公布的成績,暫未有第三方獨立測試結果。另外,Deloitte Consulting 資訊總監 Carl Bennett 在 Anthropic 的發布文章中表示,Opus 5.5 在代碼審查中找出了 72% 的已知錯誤,Opus 5 則為 56%。

網絡安全任務改由 Opus 4.8 處理

Anthropic 表示,Opus 5.5 會附設網絡安全防護,大部分網絡安全相關任務會改由舊款 Opus 4.8 處理,通過網絡安全驗證計劃(Cyber Verification Program)審核的用戶則可繼續使用。生物相關內容亦沿用與 Fable 5.1 相同的防護。據 The Verge 報道,Anthropic 形容 Opus 5.5 是在公司最全面的行為測試中表現最好的模型。

寫作風格改變 開發者要改代碼

Anthropic 又指,Opus 5.5 會把最重要的資訊放在前面,較少用術語或奇怪的慣用語。

Opus 5.5 即日起在 Claude Platform、AWS、Google Cloud 及 Microsoft Azure 提供,開發者可透過模型名稱 claude-opus-5-5 使用。不過,據 Anthropic 開發者文件,現有為 Opus 5 而寫的程式有四項改動要處理,包括思考功能不能關閉,以及強制指定工具的請求會傳回錯誤。

來源

No comments yet

提交留言即表示你已閱讀我們的私隱政策