跳到正文
MarkTechPost· Michal Sutter·· 6 小時前精選AI 評分78

Anthropic 發佈 Claude Haiku 5.5,支援 1M token 上下文窗口,輸入價格為每百萬 tokens $0.10

Anthropic Releases Claude Haiku 5.5: A Small Model With 1M Context Priced at $0.10 per Million Input Tokens

AI 導讀

Anthropic 發佈 Claude Haiku 5.5,支援 1M token 上下文窗口及最多 128K 輸出 tokens,面向摘要、分類和子智能體等高用量工作。

推薦理由

文章並列兩段式定價、基準比較和建議工作負載,呈現 Haiku 5.5 作為子智能體模型的定位,以及它與 GPT-6 Luna 的長提示詞價格差異。

正文 · 繁體中文

Anthropic 已推出 Claude Haiku 5.5,這是迄今價格最低、速度最快的小型模型。它適用於摘要、壓縮、分類及子代理任務等高用量工作。模型沿用 1M token 上下文視窗,最多可輸出 128K token。輸入 token 每百萬個 $0.10 起,輸出 token 每百萬個 $0.50 起。對於不超過 100K token 的提示詞,價格比 Claude Haiku 4.5 低 90%。

可以部署嗎?可以,形式是託管 API。Haiku 5.5 已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 及 Claude Platform on AWS 正式提供。

Anthropic 推出的內容

Haiku 5.5 是首個設有可調整推理力度設定的 Haiku 系列模型。自適應思考預設啟用,而推理力度參數的預設值為 medium。

模型可處理文字和圖片,並輸出文字,知識截至 2026 年 6 月。批次工作在 beta 版支援最多 300K 個輸出 token。

有兩項重要事項需要留意。temperature、top_p 或 top_k 設為非預設值時,會回傳 400 錯誤。新分詞器計算相同文字時,所得 token 數量亦比 Haiku 4.5 約多 30%。遷移指南涵蓋這兩方面。

價格:2 級收費架構

收費以提示詞的 100K token 為界。不超過 100K 時,輸入 token 每百萬個收費 $0.10,輸出 token 每百萬個收費 $0.50。快取讀取收費 $0.01,5 分鐘快取寫入收費 $0.125。超過 100K 時,輸入及輸出費率分別升至 $0.50 和 $2.50。

Haiku 4.5 的輸入 token 收費 $1,輸出 token 收費 $5。Anthropic 表示,Haiku 4.5 約有 90% 的請求少於 100K token。計入分詞器差異後,Anthropic 估計 Haiku 5.5 平均便宜約 75%。批次處理可再減價 50%。

GPT-6 Luna列出的短上下文費率相同。它只在輸入 token 超過 272K 時進入較高級別,費率為 $0.20 和 $0.75。對於 150K token 的提示詞,Luna 的標價較低。

基準測試

以下數據均由 Anthropic 提供(見系統卡):

  • OSWorld 2.1(離線子集):72.4%;GPT-6 Luna 為 48.9%,Haiku 4.5 為 15.7%。
  • Terminal-Bench 4.0:39.2%;Luna 為 16.4%,Haiku 4.5 為 0.0%。
  • FrontierCode 1.1(Main):46.4%;Luna 為 42.4%。
  • Humanity’s Last Exam:不使用工具時為 45.9%,使用工具時為 57.4%。
  • GDPval-AA v2.1:1620;Luna 為 1437,Haiku 4.5 為 735。

Sonnet 5.5 在所有項目仍然領先,包括 Terminal-Bench 4.0 的 70.6%。Anthropic 本身建議,複雜的代理式編碼工作使用 Sonnet 5.5 和 Opus 5.5。

最佳使用場景

有三類工作最適合 Haiku 5.5:

  • 第一類是在 Opus 5.5 或 Sonnet 5.5 下執行子代理工作。在 Rogo,一個 Haiku 5.5 子代理會擷取 10-K 報告中的收入項目,同時由較大型模型製作簡報。
  • 第二類是大量文件問答(Q&A)及摘要。AlphaSense 在一項每週處理約 8M 次呼叫的功能上測試了 Haiku 5.5。
  • 第三類是對速度要求較高的工作,例如即時客戶支援和瀏覽器操作。

Haiku 5.5 與最接近的競爭對手比較

功能Claude Haiku 5.5GPT-6 LunaGemini 3.5 Flash-Lite
輸入/輸出(每 1M)$0.10 / $0.50$0.10 / $0.50$0.30 / $2.50
長提示詞價格超過 100K 時為 $0.50 / $2.50超過 272K 時為 $0.20 / $0.75固定費率
快取讀取(每 1M)$0.01$0.01$0.03 + 儲存費
上下文視窗1M token1,050,000 token1,048,576 token
最大輸出量128K tokens128,000 tokens65,536 tokens
輸入內容文字、圖片文字、圖片文字、圖片、影片、音訊、PDF
推理控制自適應思考 + 推理力度(預設為 medium)reasoning.effort 由 none 至 max(預設為 medium)支援思考功能
電腦操作SDK 支援處於 beta 階段支援(Responses API)支援(預覽版)
批次折扣50%50%(Batch 和 Flex)50%
知識截止日期2026 年 6 月2026 年 5 月 18 日模型頁面沒有列出
可在哪裏執行Claude API、Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWSOpenAI APIGemini API

來源: Anthropic 文件、Anthropic 公告、OpenAI 模型頁面、OpenAI 定價、Google 模型頁面、Google 定價。標準級別牌價,已於 2026 年 10 月 7 日核實。

互動式解説

重點摘要

  • 提示詞不超過 100K tokens 時,每 1M tokens 的輸入費用為 $0.10,輸出費用為 $0.50。
  • 1M 上下文、128K 輸出,並支援自適應思考及推理力度設定(預設為 medium)。
  • OSWorld 2.1 上為 72.4%,Haiku 4.5 則為 15.7%(Anthropic 報告)。
  • 短上下文情況下的牌價與 GPT-6 Luna 相同;超過 100K tokens 時,Luna 價格較低。
  • 定位為 Opus 5.5 和 Sonnet 5.5 之下的子代理,而非編碼主力。

請參閲技術詳情。所有功勞均歸於本項目的研究人員。另外, 歡迎在 Twitter 追蹤我們,也別忘了加入我們的 150k+ML SubReddit 並訂閲我們的電子報。等等,你有使用 Telegram 嗎? 現在你也可以在 Telegram 上加入我們。

[贊助內容] 網絡是大多數 Agent 缺少的那個 API。資料庫、日曆和程式碼儲存庫都有 API;開放網絡大多沒有。TinyFish MCP server 為任何 MCP 用戶端提供四種工具:TinySearch、TinyFetch(以 Markdown 格式擷取完整頁面,並支援 JavaScript)、TinyBrowser(用於登入和表單),以及 TinyAgent(用於多步驟工作)。Search 和 Fetch 免費使用。

文章 Anthropic 發布 Claude Haiku 5.5:具備 1M 上下文、每百萬輸入 tokens 定價 $0.10 的小型模型 最初刊載於 MarkTechPost。

來源:MarkTechPost · marktechpost.com