Anthropic 發佈 Claude Haiku 5.5,支援 1M token 上下文窗口,輸入價格為每百萬 tokens $0.10
Anthropic Releases Claude Haiku 5.5: A Small Model With 1M Context Priced at $0.10 per Million Input Tokens
Anthropic 發佈 Claude Haiku 5.5,支援 1M token 上下文窗口及最多 128K 輸出 tokens,面向摘要、分類和子智能體等高用量工作。
文章並列兩段式定價、基準比較和建議工作負載,呈現 Haiku 5.5 作為子智能體模型的定位,以及它與 GPT-6 Luna 的長提示詞價格差異。
Anthropic 已推出 Claude Haiku 5.5,這是迄今價格最低、速度最快的小型模型。它適用於摘要、壓縮、分類及子代理任務等高用量工作。模型沿用 1M token 上下文視窗,最多可輸出 128K token。輸入 token 每百萬個 $0.10 起,輸出 token 每百萬個 $0.50 起。對於不超過 100K token 的提示詞,價格比 Claude Haiku 4.5 低 90%。
可以部署嗎?可以,形式是託管 API。Haiku 5.5 已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 及 Claude Platform on AWS 正式提供。
Anthropic 推出的內容
Haiku 5.5 是首個設有可調整推理力度設定的 Haiku 系列模型。自適應思考預設啟用,而推理力度參數的預設值為 medium。
模型可處理文字和圖片,並輸出文字,知識截至 2026 年 6 月。批次工作在 beta 版支援最多 300K 個輸出 token。
有兩項重要事項需要留意。temperature、top_p 或 top_k 設為非預設值時,會回傳 400 錯誤。新分詞器計算相同文字時,所得 token 數量亦比 Haiku 4.5 約多 30%。遷移指南涵蓋這兩方面。
價格:2 級收費架構
收費以提示詞的 100K token 為界。不超過 100K 時,輸入 token 每百萬個收費 $0.10,輸出 token 每百萬個收費 $0.50。快取讀取收費 $0.01,5 分鐘快取寫入收費 $0.125。超過 100K 時,輸入及輸出費率分別升至 $0.50 和 $2.50。
Haiku 4.5 的輸入 token 收費 $1,輸出 token 收費 $5。Anthropic 表示,Haiku 4.5 約有 90% 的請求少於 100K token。計入分詞器差異後,Anthropic 估計 Haiku 5.5 平均便宜約 75%。批次處理可再減價 50%。
GPT-6 Luna列出的短上下文費率相同。它只在輸入 token 超過 272K 時進入較高級別,費率為 $0.20 和 $0.75。對於 150K token 的提示詞,Luna 的標價較低。
基準測試
以下數據均由 Anthropic 提供(見系統卡):
- OSWorld 2.1(離線子集):72.4%;GPT-6 Luna 為 48.9%,Haiku 4.5 為 15.7%。
- Terminal-Bench 4.0:39.2%;Luna 為 16.4%,Haiku 4.5 為 0.0%。
- FrontierCode 1.1(Main):46.4%;Luna 為 42.4%。
- Humanity’s Last Exam:不使用工具時為 45.9%,使用工具時為 57.4%。
- GDPval-AA v2.1:1620;Luna 為 1437,Haiku 4.5 為 735。
Sonnet 5.5 在所有項目仍然領先,包括 Terminal-Bench 4.0 的 70.6%。Anthropic 本身建議,複雜的代理式編碼工作使用 Sonnet 5.5 和 Opus 5.5。
最佳使用場景
有三類工作最適合 Haiku 5.5:
- 第一類是在 Opus 5.5 或 Sonnet 5.5 下執行子代理工作。在 Rogo,一個 Haiku 5.5 子代理會擷取 10-K 報告中的收入項目,同時由較大型模型製作簡報。
- 第二類是大量文件問答(Q&A)及摘要。AlphaSense 在一項每週處理約 8M 次呼叫的功能上測試了 Haiku 5.5。
- 第三類是對速度要求較高的工作,例如即時客戶支援和瀏覽器操作。
Haiku 5.5 與最接近的競爭對手比較
| 功能 | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| 輸入/輸出(每 1M) | $0.10 / $0.50 | $0.10 / $0.50 | $0.30 / $2.50 |
| 長提示詞價格 | 超過 100K 時為 $0.50 / $2.50 | 超過 272K 時為 $0.20 / $0.75 | 固定費率 |
| 快取讀取(每 1M) | $0.01 | $0.01 | $0.03 + 儲存費 |
| 上下文視窗 | 1M token | 1,050,000 token | 1,048,576 token |
| 最大輸出量 | 128K tokens | 128,000 tokens | 65,536 tokens |
| 輸入內容 | 文字、圖片 | 文字、圖片 | 文字、圖片、影片、音訊、PDF |
| 推理控制 | 自適應思考 + 推理力度(預設為 medium) | reasoning.effort 由 none 至 max(預設為 medium) | 支援思考功能 |
| 電腦操作 | SDK 支援處於 beta 階段 | 支援(Responses API) | 支援(預覽版) |
| 批次折扣 | 50% | 50%(Batch 和 Flex) | 50% |
| 知識截止日期 | 2026 年 6 月 | 2026 年 5 月 18 日 | 模型頁面沒有列出 |
| 可在哪裏執行 | Claude API、Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWS | OpenAI API | Gemini API |
來源: Anthropic 文件、Anthropic 公告、OpenAI 模型頁面、OpenAI 定價、Google 模型頁面、Google 定價。標準級別牌價,已於 2026 年 10 月 7 日核實。
互動式解説
重點摘要
- 提示詞不超過 100K tokens 時,每 1M tokens 的輸入費用為 $0.10,輸出費用為 $0.50。
- 1M 上下文、128K 輸出,並支援自適應思考及推理力度設定(預設為
medium)。 - OSWorld 2.1 上為 72.4%,Haiku 4.5 則為 15.7%(Anthropic 報告)。
- 短上下文情況下的牌價與 GPT-6 Luna 相同;超過 100K tokens 時,Luna 價格較低。
- 定位為 Opus 5.5 和 Sonnet 5.5 之下的子代理,而非編碼主力。
請參閲技術詳情。所有功勞均歸於本項目的研究人員。另外, 歡迎在 Twitter 追蹤我們,也別忘了加入我們的 150k+ML SubReddit 並訂閲我們的電子報。等等,你有使用 Telegram 嗎? 現在你也可以在 Telegram 上加入我們。
文章 Anthropic 發布 Claude Haiku 5.5:具備 1M 上下文、每百萬輸入 tokens 定價 $0.10 的小型模型 最初刊載於 MarkTechPost。
來源:MarkTechPost · marktechpost.com