Anthropic 推出 Claude Haiku 5.5,官方指平均運行成本低約 75%
Anthropic 在香港時間 10 月 8 日凌晨發布 Claude Haiku 5.5,形容它是公司至今最便宜、最快,亦是能力最強的小型模型。官方公告指,與上一代 Haiku 4.5 相比,Haiku 5.5 處理同類工作的平均運行成本低約 75%。
這款模型主打大量、講求成本的工作,例如摘要、分類、資料庫查詢及即時客服,亦可在 Opus 5.5 或 Sonnet 5.5 之下擔任分工的子代理(subagent),負責寫程式時的零碎任務。
每百萬 token 輸入 0.1 美元,較 Haiku 4.5 便宜九成
據 Anthropic 產品頁,Haiku 5.5 的收費按提示長度分兩級。提示在 10 萬 token 以內,每百萬輸入 token 收 0.1 美元、輸出 0.5 美元;超過 10 萬 token,則分別收 0.5 美元及 2.5 美元。翻查資料,Haiku 4.5 的定價是每百萬輸入 token 1 美元、輸出 5 美元,即短提示的單價減了九成。
項目 | Haiku 5.5(≤10 萬 token) | Haiku 5.5(>10 萬 token) | Haiku 4.5 |
|---|---|---|---|
輸入(每百萬 token) | 0.1 美元 | 0.5 美元 | 1 美元 |
輸出(每百萬 token) | 0.5 美元 | 2.5 美元 | 5 美元 |
官方解釋,10 萬 token 以內的提示約佔上一代 Haiku 九成請求,因此 Haiku 5.5 在這類工作上最划算。《VentureBeat》報道指,新定價與 OpenAI 的 GPT-6 Luna 看齊。Anthropic 同時把 Sonnet 5.5 讀取快取的收費減半,並為 Claude Max 及 Team 訂閱用戶新增每月 API 額度。
第一款可調「思考力度」的 Haiku
Anthropic 表示,Haiku 5.5 是首款設有可調思考力度(effort)的 Haiku 模型,開發者可按每個請求決定偏重成本還是能力。模型支援 100 萬 token 的上下文,單次最多輸出 12.8 萬 token。

電腦操作測試由 15.7% 升至 72.4%
據官方公布的成績,Haiku 5.5 在 OSWorld 2.1 電腦操作測試取得 72.4%,Haiku 4.5 只得 15.7%,GPT-6 Luna 為 48.9%。在 Terminal-Bench 4.0 代理式編程測試中,Haiku 5.5 得 39.2%,Haiku 4.5 為 0%。
測試 | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna |
|---|---|---|---|
OSWorld 2.1(電腦操作) | 72.4% | 15.7% | 48.9% |
Terminal-Bench 4.0(代理式編程) | 39.2% | 0% | 16.4% |
FrontierCode 1.1(代理式編程) | 46.4% | 未有數字 | 42.4% |
Humanity's Last Exam(不用工具) | 45.9% | 10.2% | 未有數字 |
Box 人工智能產品副總裁 Yashodha Bhavnani 在官方公告中表示,早期測試裏 Haiku 5.5 的分數比 Haiku 4.5 高 11 分,延遲約為一半。
Claude 免費用戶亦可使用
Anthropic 指,Claude.ai 的免費、Pro、Max、Team 及企業用戶均可在網頁、iOS 及 Android 版選用 Haiku 5.5,Claude Code 亦已支援。開發者可經 Claude Platform、Amazon Web Services、Google Cloud 及 Microsoft Foundry 使用,模型 ID 為 claude-haiku-5-5。
翻查資料,Anthropic 在 9 月 22 日推出 Opus 5.5 時已預告 Haiku 5.5 會在數周內跟上,Sonnet 5.5 則在 9 月 28 日推出。




No comments yet
提交留言即表示你已閱讀我們的私隱政策。