close
人工智能

Claude Haiku 5.5 開發者懶人包:一文睇盡價格、API、Effort 設定與升級重點


Claude Haiku 5.5 logo與文字設計元素.

Anthropic 於 2026 年 10 月 7 日推出 Claude Haiku 5.5,主打高用量、成本敏感及需要快速回應的工作。新模型適合摘要、內容壓縮、數據庫查詢、分類、即時客服,以及在編程流程中擔任 Subagent。Claude API 的模型名稱為 claude-haiku-5-5,100K tokens 以內的 Prompt,每百萬輸入 tokens 收費 0.10 美元,每百萬輸出 tokens 收費 0.50 美元。

對開發者而言,這次更新不只是價格下降:Haiku 首次加入可調整的 Effort 設定,並擴大上下文容量。升級時亦需要重新檢查 Thinking、輸出上限、工具調用及拒絕回應處理,不能只更換模型名稱便直接上線。

 

Haiku 5.5 在甚麼情況下使用

  • 高用量工作:分類、資料擷取、摘要、請求路由及內容壓縮,可優先評估 Haiku 5.5。
  • 需要快速回應的產品:官方點名即時客服及 Browser Use,適合測試延遲與成本能否符合產品要求。
  • 多模型 Agent:可由 Sonnet 5.5 或 Opus 5.5 負責主導,再把範圍清楚的子任務交給 Haiku 5.5。
  • 複雜編程:官方仍建議使用 Sonnet 5.5 或 Opus 5.5,尤其是長步驟、需要多次工具操作的任務。
  • 升級起點:官方建議先用 medium effort,再按自己的評測調整;更高 Effort 不代表每項工作都值得付出額外成本。

供應平台與模型名稱

官方公告確認,Haiku 5.5 已在各平台提供,包括 Amazon Web Services、Google Cloud 及 Microsoft Azure。在 Claude Platform 上,開發者可使用 claude-haiku-5-5。

上一篇按官方 Models Overview 整理的各平台識別名稱如下。雲端平台的實際調用方式仍應以該平台文件為準:

平台 模型識別名稱
Claude API claude-haiku-5-5
Amazon Bedrock anthropic.claude-haiku-5-5
Google Cloud claude-haiku-5-5
Microsoft Foundry claude-haiku-5-5
Claude Platform on AWS claude-haiku-5-5

Models Overview 列出的 Haiku 5.5 退役時間下限為 2027 年 10 月 7 日,即不會早於該日退役;這並非已宣布的退役日期。

規格:上下文、輸出與 Thinking 有甚麼改變?

以下規格沿用上一篇從官方 Models Overview 及 Haiku 4.5 文件整理的資料。發布公告 PDF 並未列出全部 API 規格。

項目 Haiku 5.5 Haiku 4.5 Sonnet 5.5
Claude API 模型名稱 claude-haiku-5-5 claude-haiku-4-5-20251001;別名 claude-haiku-4-5 claude-sonnet-5-5
上下文視窗 1M tokens 200K tokens 1M tokens
最大輸出 128K tokens 64K tokens 128K tokens
Thinking Adaptive Extended;使用 budget_tokens Adaptive
預設 Effort medium 不支援 high
知識截止 2026 年 6 月 2025 年 2 月 2026 年 6 月
輸入與輸出 文字及圖像輸入;文字輸出 文字及圖像輸入;文字輸出 文字及圖像輸入;文字輸出

Haiku 4.5 已列作 Legacy 模型。上一篇讀取的官方文件表示,其退役時間不會早於 2026 年 10 月 15 日,並建議遷移至 Haiku 5.5。「不早於」不代表當日一定停止服務,團隊仍應留意正式退役通知。

API 價格:100K 是低價門檻,1M 是上下文容量

Haiku 5.5 按 Prompt 是否超過 100,000 tokens 分成兩級收費。以下價格已逐項對照官方公告 PDF,單位均為每百萬 tokens,美元計價:

計費項目 Haiku 5.5:Prompt 不超過 100K Haiku 5.5:Prompt 超過 100K Haiku 4.5 Sonnet 5.5
輸入 tokens US$0.10 US$0.50 US$1.00 US$2.00
輸出 tokens US$0.50 US$2.50 US$5.00 US$10.00
快取讀取 US$0.01 US$0.05 US$0.10 US$0.10
快取寫入 US$0.125 US$0.625 US$1.25 US$2.50

不要把 1M 上下文容量理解成所有請求都享有 100K 以內的低價。當 Prompt 超過 100K,公告列出的輸入、輸出與快取單價均提高至低價級別的 5 倍。

官方表示,100K 以內的請求單價較 Haiku 4.5 低 90%,超過 100K 則低 50%。Haiku 4.5 約九成請求落在前一級別。

另一個需要分清的數字是「平均運行成本低約 75%」。這是 Anthropic 的整體估算,並非每項任務都固定節省 75%。官方註腳說明,估算已考慮新版 Tokenizer 的影響:Haiku 5.5 採用與 Sonnet 5.5、Opus 5.5 相近的 Tokenizer,每項工作可能消耗略多 tokens。

因此,團隊應比較完成同一任務的總費用,而非只比較每百萬 token 的單價。Thinking、輸出長度、重試次數及工具調用,都會影響實際成本。

Prompt Caching 與 Batch API

官方公告列出,Haiku 5.5 的 Prompt 不超過 100K tokens 時,每百萬快取讀取 tokens 收費 US$0.01,快取寫入收費 US$0.125;Prompt 超過 100K 時,兩項價格分別為 US$0.05 及 US$0.625。

Anthropic 同時宣布,Sonnet 5.5 的快取讀取價格即日起減半,由每百萬 tokens US$0.20 降至 US$0.10。官方表示,快取讀取佔 Agent 工作相當部分的 token 消耗,因此這次降價令 Sonnet 5.5 在大部分 Agent 任務中的運行成本約低 20%。

Effort:先從 medium 起步,再按評測調整

Haiku 5.5 是首款加入可調整 Effort 設定的 Haiku 模型。官方公告指出,開發者可藉此取捨成本與能力。

  • low:適合簡單對話、短篇工具任務及大量重複請求,但長篇 Agent 任務可能出現略過搜尋、提早結束或跳過驗證。
  • medium:官方建議的起步設定,包括 Agent 編程。
  • high:適合知識工作、長篇 Agent 任務,以及需要較嚴格遵循指令的情境。
  • xhigh、max:只有在自己的評測顯示品質改善值得額外成本時才使用,並應與 Sonnet 5.5 比較。

不同語言模型在準確率與成本上的比較圖表.

這份 PDF 的 OSWorld 圖表顯示,Haiku 5.5 從 low 提升至 max,測試得分與每次嘗試成本均上升。圖表反映的是特定評測下的取捨,不能直接當作你產品中的成功率或費用。

閱讀時還要留意,橫軸採用對數刻度,而且單位是「每次嘗試的成本」,不是每百萬 tokens 價格。本文不從圖中估讀精確座標,避免把近似值寫成官方公布數字。

Thinking 與 max_tokens:舊設定未必能直接沿用

Haiku 5.5 使用 Adaptive Thinking,Effort 取代 Haiku 4.5 原有的 budget_tokens 設定。Thinking 預設啟用,思考 tokens 亦計入 max_tokens。

如果舊系統在 Haiku 4.5 關閉 Thinking 時設定了較小的 max_tokens,搬到 Haiku 5.5 後可能沒有足夠空間同時容納思考與答案,導致輸出截斷。升級時應按實際工作重新設定上限,而非一律使用最大值。

在 high 或以下 Effort,可用 thinking: {"type": "disabled"} 關閉 Thinking;xhigh 與 max 若關閉 Thinking,則會返回 HTTP 400,應使用 Adaptive Thinking。只在 Prompt 中要求「直接回答」,並不能可靠地阻止內部思考。

官方文件亦提醒,xhigh 的多輪對話有時會把答案寫在 thinking 區塊,最終沒有可見文字。應用程式需要檢查文字輸出是否為空,不能只以請求成功判斷任務完成。

多輪 Agent:改 Effort 時留意快取

在對話頂層更改 Effort 會令現有 Prompt Cache 失效。若希望按回合調整 Effort 並保留快取,可參考 Per-message Effort Beta。

上一篇讀取的 Effort 文件列出 Beta Header mid-conversation-output-config-2026-07-01,並要求配合 Adaptive Thinking。當時文件列出 Claude API 與 Google Cloud 支援 Haiku 5.5,Amazon Bedrock 的支援列表未涵蓋此組合。

使用 Per-message Effort 時,如果 Thinking 已關閉,中途改變 Effort 會觸發 400。這個限制屬於該 Beta 功能,不能泛化成所有 Effort 設定都不可更改。

工具、Structured Outputs 與 Browser Use

官方公告確認,Claude Python 與 TypeScript SDK 正加入 Computer Use 及 Browser Use 的 Beta 支援。Anthropic 認為,Haiku 5.5 的速度、能力與價格組合特別適合這類工作;公告未列出 SDK 最低版本,安裝時應按 SDK 文件確認。

官方 Prompting 指南亦列出以下注意事項:

  • Thinking 關閉並要求 JSON 輸出時,模型可能略過必要工具調用。可改用 Adaptive Thinking,或在需要工具的請求中移除 output_config.format,亦可按需求使用 tool_choice。
  • 長篇編程 Agent 在 low effort 下可能提早结束。文件指出,提升至 medium 可減少約一半提早中斷的情況,但每次嘗試的輸出 token 消耗會增加超過一倍;這是文件中的測試觀察,不代表所有應用都有相同變化。
  • low 與 medium 有時會在未作實質檢查前回報程式碼修改完成。開發流程仍應以測試結果驗證完成狀態。
  • 用戶中途新增的指示不應混入 tool_result;應作為 user turn,附在最後一個 tool_result 之後。
  • 提供搜尋工具時,可在 system prompt 或工具描述加入當前日期。
  • 需要持續遵循對話規則時,文件建議在 system prompt 明示規則在整段對話中有效,並評估使用 high effort。

Benchmark:哪些能力提升最明顯?

以下成績已對照官方 PDF 中的 Performance 表格。這些是 Anthropic 公布的評測結果,並非本文獨立測試:

評測 Haiku 5.5 Haiku 4.5 GPT-6 Luna Sonnet 5.5:參考值
GDPval-AA v2.1 1620 735 1437 1840
AA-Briefcase v1.1 1578 614 1336 1824
OSWorld 2.1:離線子集 72.4% 15.7% 48.9% 83.9%
Humanity’s Last Exam:無工具 45.9% 10.2% 未列出 56.9%
Humanity’s Last Exam:有工具 57.4% 18.7% 未列出 64.5%
Terminal-Bench 4.0 39.2% 0.0% 16.4% 70.6%
FrontierCode 1.1:Main 46.4% 未列出 42.4% 52.1%;Xhigh
Chartography:無工具 46.4% 6.4% 29.1% 61.6%

OSWorld 使用離線子集,Humanity’s Last Exam 分有工具與無工具兩種設定,Chartography 則標明無工具。Sonnet 5.5 的 FrontierCode 成績另標示 Xhigh,不能把整張表理解成所有模型都在相同 Effort 下測試。

官方把 Sonnet 5.5 列作參考,並要求讀者到 System Card 查閱完整評測方法。這份 PDF 沒有收錄 System Card,因此測試框架、其餘 Effort 設定及完整條件仍未在本次本地覆核中確認。

表中的 Haiku 4.5 Terminal-Bench 4.0 成績為 0.0%,只能代表該項測試結果,不能據此概括舊模型完全沒有編程能力。

速度與客戶實測:比較對象要看清楚

Anthropic 在註腳限定「最快」的比較方式:以各模型的標準速度計算,Haiku 5.5 是旗下最快模型,但仍慢於 Opus 的 Fast Mode。公告沒有公布具體每秒 token 吞吐量。

這份 PDF 可核對的客戶引述包括:

  • Asana:在 AI Teammates 的評測中,涵蓋錯誤分類、建立專案及搜尋大型專案組合等任務。相較其當時使用的模型,完成任務的延遲減少逾 30%,每個 Agent 回合的推理速度最高提升 2.5 倍。引述没有指明比較模型,因此不能寫成全部數字都以 Haiku 4.5 為基準。
  • HubSpot:以模擬 CRM 環境評測模型,Haiku 5.5 在三次測試中平均取得 92.8%,是該公司測試套件當時所見的最高分。對一項辨識過時但含糊紀錄的 CRM 審核任務,HubSpot 表示它完成最快、命中率最高,誤報率亦最低。

以上是客戶在特定工作流程中的觀察,不是適用所有開發者的速度或準確率保證。

何時應改用 Sonnet 5.5 或 Opus 5.5?

官方公告的分工相當清楚:Haiku 5.5 適合範圍較窄的任務,例如內容壓縮、摘要及 Subagent 工作;複雜 Agent 編程則仍以 Sonnet 5.5 或 Opus 5.5 更合適。

PDF 中的 Terminal-Bench 4.0 成本曲線亦呈現這項差異:提高 Haiku 5.5 的 Effort 可以提升得分,但 Sonnet 5.5 在圖中達到更高成績。開發者應同時比較任務成功率與每次完成成本,不能只用 token 單價選模型。

20261008111208
實作上可先讓 Haiku 處理資料整理、初步分類或單一工具工作,再把需要長程規劃、多步修正或較高成功率的部分交給較大型模型。這是按官方模型定位提出的架構建議,仍需以你的任務評測驗證。

安全防護:網絡安全與生物研究有不同限制

官方公告表示,Haiku 5.5 相較 Haiku 4.5,在大部分 alignment 評測中有所改善,包括較少出現行為偏離及較低的濫用配合意願。完整方法與結果仍需參閱 System Card。

網絡安全方面,Haiku 5.5 的防護較 Haiku 4.5 嚴格,但較其他近期模型略為寬鬆。它允許比 Sonnet 5.5 更廣泛的防禦性安全工作,仍會攔截滲透測試及其他較可能被攻擊者使用的技術。

生物研究方面,公告指出 Haiku 5.5 採用與 Sonnet 5、Sonnet 5.5 及 Opus 5 相同的防護安排,允許研究性生物學問題,但限制官方判斷可能造成傷害的請求。涉及更廣泛生物或網絡安全活動的機構,可申請 Life Sciences Verification Program 或 Cyber Verification Program。

對相關產品而言,升級前應測試現有合法工作流程是否會被拒絕,並設計清楚的錯誤處理;不能假設 Haiku 4.5 能完成的請求,在新版一定原樣通過。

由 Haiku 4.5 遷移:需要檢查甚麼?

上一篇整理的官方 Prompting 指南表示,Haiku 4.5 的 Prompt 一般可沿用,但升級涉及 5 項破壞性 API 變更。這份公告 PDF 提供了 Migration Guide 連結,沒有列出完整五項內容,因此以下並非完整遷移清單:

  • 模型名稱:改為 claude-haiku-5-5。
  • Thinking:按新版 Effort 與 Adaptive Thinking 方式調整,不直接沿用 budget_tokens。
  • 輸出預算:重新設定 max_tokens,為思考與答案預留空間。
  • 成本:重新量度實際 token 消耗,並檢查 Prompt 是否跨過 100K 計價門檻。
  • 工具工作:測試 JSON 輸出、工具調用及長任務是否正常完成。
  • 拒絕處理:上一篇文件整理列出 stop_reason: "refusal",以及 stop_details.category 的 cyber、frontier_llm、bio、general_harms 等類別;客戶端需處理此類回應。
  • Fallback:上一篇文件表示 Haiku 5.5 尚未支援 Server-side Fallback Beta;不要只靠原樣重送相同請求處理拒絕。

正式升級前,應閱讀 Haiku 5.5 Migration Guide,並用現有工作集測試成功率、延遲、工具行為與總費用。本文未讀取該指南全文,不會補造其餘破壞性變更。

最小 Python API 範例

以下沿用上一篇根據官方 Effort 文件改寫的 Python SDK 範例,使用公告確認的模型名稱與 medium effort。它不是官方原文範例,亦未實際執行:

import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=4096,
    messages=[
        {
            "role": "user",
            "content": (
                "Summarize this support ticket in one sentence: "
                "The customer cannot reset their password because "
                "the reset email never arrives."
            ),
        }
    ],
    output_config={"effort": "medium"},
)

for block in response.content:
    if block.type == "text":
        print(block.text)

使用前需按官方 SDK 文件完成安裝及 API 金鑰設定。正式產品亦應處理輸出截斷、沒有文字答案、拒絕回應及 API 錯誤,並按工作量調整輸出預算。

同日更新:Sonnet 快取降價與訂閱 API 額度

官方 PDF 確認,Sonnet 5.5 的快取讀取價即日起由每百萬 tokens US$0.20 降至 US$0.10。Anthropic 表示,由於快取讀取佔不少 Agent 工作的 token 消耗,這令大部分 Agent 任務的運行成本約低 20%;並非所有任務或全部計費項目都直接減價 20%。

Anthropic 同時宣布,本週向 Max 及 Team 訂閱用戶推出每月 Claude Platform API 額度:

訂閱方案 每月 API 額度
Max 5x US$100
Max 20x US$200
Team 最高 US$500,由團隊用戶共用

額度可用於任何 Claude 模型。Team 的最高 US$500 是團隊共用額度,並非每名成員各有 US$500;公告亦只表示「本週推出」,不能據此判定每個帳戶已即時收到。領取方式與其他條件可查閱 官方 Help Center 說明。

資料來源:
Anthropic 官方發布公告、
Claude Models Overview、
Effort 文件、
Migration Guide、
Browser Use SDK 文件

 

Tags : AnthropicAPIClaudeHaiku 5.5人工智能開發者