
Anthropic 於 2026 年 10 月 7 日推出 Claude Haiku 5.5,主打高用量、成本敏感及需要快速回應的工作。新模型適合摘要、內容壓縮、數據庫查詢、分類、即時客服,以及在編程流程中擔任 Subagent。Claude API 的模型名稱為 claude-haiku-5-5,100K tokens 以內的 Prompt,每百萬輸入 tokens 收費 0.10 美元,每百萬輸出 tokens 收費 0.50 美元。
對開發者而言,這次更新不只是價格下降:Haiku 首次加入可調整的 Effort 設定,並擴大上下文容量。升級時亦需要重新檢查 Thinking、輸出上限、工具調用及拒絕回應處理,不能只更換模型名稱便直接上線。
Haiku 5.5 在甚麼情況下使用
- 高用量工作:分類、資料擷取、摘要、請求路由及內容壓縮,可優先評估 Haiku 5.5。
- 需要快速回應的產品:官方點名即時客服及 Browser Use,適合測試延遲與成本能否符合產品要求。
- 多模型 Agent:可由 Sonnet 5.5 或 Opus 5.5 負責主導,再把範圍清楚的子任務交給 Haiku 5.5。
- 複雜編程:官方仍建議使用 Sonnet 5.5 或 Opus 5.5,尤其是長步驟、需要多次工具操作的任務。
- 升級起點:官方建議先用 medium effort,再按自己的評測調整;更高 Effort 不代表每項工作都值得付出額外成本。
供應平台與模型名稱
官方公告確認,Haiku 5.5 已在各平台提供,包括 Amazon Web Services、Google Cloud 及 Microsoft Azure。在 Claude Platform 上,開發者可使用 claude-haiku-5-5。
上一篇按官方 Models Overview 整理的各平台識別名稱如下。雲端平台的實際調用方式仍應以該平台文件為準:
| 平台 | 模型識別名稱 |
|---|---|
| Claude API | claude-haiku-5-5 |
| Amazon Bedrock | anthropic.claude-haiku-5-5 |
| Google Cloud | claude-haiku-5-5 |
| Microsoft Foundry | claude-haiku-5-5 |
| Claude Platform on AWS | claude-haiku-5-5 |
Models Overview 列出的 Haiku 5.5 退役時間下限為 2027 年 10 月 7 日,即不會早於該日退役;這並非已宣布的退役日期。
規格:上下文、輸出與 Thinking 有甚麼改變?
以下規格沿用上一篇從官方 Models Overview 及 Haiku 4.5 文件整理的資料。發布公告 PDF 並未列出全部 API 規格。
| 項目 | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Claude API 模型名稱 | claude-haiku-5-5 | claude-haiku-4-5-20251001;別名 claude-haiku-4-5 | claude-sonnet-5-5 |
| 上下文視窗 | 1M tokens | 200K tokens | 1M tokens |
| 最大輸出 | 128K tokens | 64K tokens | 128K tokens |
| Thinking | Adaptive | Extended;使用 budget_tokens | Adaptive |
| 預設 Effort | medium | 不支援 | high |
| 知識截止 | 2026 年 6 月 | 2025 年 2 月 | 2026 年 6 月 |
| 輸入與輸出 | 文字及圖像輸入;文字輸出 | 文字及圖像輸入;文字輸出 | 文字及圖像輸入;文字輸出 |
Haiku 4.5 已列作 Legacy 模型。上一篇讀取的官方文件表示,其退役時間不會早於 2026 年 10 月 15 日,並建議遷移至 Haiku 5.5。「不早於」不代表當日一定停止服務,團隊仍應留意正式退役通知。
API 價格:100K 是低價門檻,1M 是上下文容量
Haiku 5.5 按 Prompt 是否超過 100,000 tokens 分成兩級收費。以下價格已逐項對照官方公告 PDF,單位均為每百萬 tokens,美元計價:
| 計費項目 | Haiku 5.5:Prompt 不超過 100K | Haiku 5.5:Prompt 超過 100K | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| 輸入 tokens | US$0.10 | US$0.50 | US$1.00 | US$2.00 |
| 輸出 tokens | US$0.50 | US$2.50 | US$5.00 | US$10.00 |
| 快取讀取 | US$0.01 | US$0.05 | US$0.10 | US$0.10 |
| 快取寫入 | US$0.125 | US$0.625 | US$1.25 | US$2.50 |
不要把 1M 上下文容量理解成所有請求都享有 100K 以內的低價。當 Prompt 超過 100K,公告列出的輸入、輸出與快取單價均提高至低價級別的 5 倍。
官方表示,100K 以內的請求單價較 Haiku 4.5 低 90%,超過 100K 則低 50%。Haiku 4.5 約九成請求落在前一級別。
另一個需要分清的數字是「平均運行成本低約 75%」。這是 Anthropic 的整體估算,並非每項任務都固定節省 75%。官方註腳說明,估算已考慮新版 Tokenizer 的影響:Haiku 5.5 採用與 Sonnet 5.5、Opus 5.5 相近的 Tokenizer,每項工作可能消耗略多 tokens。
因此,團隊應比較完成同一任務的總費用,而非只比較每百萬 token 的單價。Thinking、輸出長度、重試次數及工具調用,都會影響實際成本。
Prompt Caching 與 Batch API
官方公告列出,Haiku 5.5 的 Prompt 不超過 100K tokens 時,每百萬快取讀取 tokens 收費 US$0.01,快取寫入收費 US$0.125;Prompt 超過 100K 時,兩項價格分別為 US$0.05 及 US$0.625。
Anthropic 同時宣布,Sonnet 5.5 的快取讀取價格即日起減半,由每百萬 tokens US$0.20 降至 US$0.10。官方表示,快取讀取佔 Agent 工作相當部分的 token 消耗,因此這次降價令 Sonnet 5.5 在大部分 Agent 任務中的運行成本約低 20%。
Effort:先從 medium 起步,再按評測調整
Haiku 5.5 是首款加入可調整 Effort 設定的 Haiku 模型。官方公告指出,開發者可藉此取捨成本與能力。
- low:適合簡單對話、短篇工具任務及大量重複請求,但長篇 Agent 任務可能出現略過搜尋、提早結束或跳過驗證。
- medium:官方建議的起步設定,包括 Agent 編程。
- high:適合知識工作、長篇 Agent 任務,以及需要較嚴格遵循指令的情境。
- xhigh、max:只有在自己的評測顯示品質改善值得額外成本時才使用,並應與 Sonnet 5.5 比較。

這份 PDF 的 OSWorld 圖表顯示,Haiku 5.5 從 low 提升至 max,測試得分與每次嘗試成本均上升。圖表反映的是特定評測下的取捨,不能直接當作你產品中的成功率或費用。
閱讀時還要留意,橫軸採用對數刻度,而且單位是「每次嘗試的成本」,不是每百萬 tokens 價格。本文不從圖中估讀精確座標,避免把近似值寫成官方公布數字。
Thinking 與 max_tokens:舊設定未必能直接沿用
Haiku 5.5 使用 Adaptive Thinking,Effort 取代 Haiku 4.5 原有的 budget_tokens 設定。Thinking 預設啟用,思考 tokens 亦計入 max_tokens。
如果舊系統在 Haiku 4.5 關閉 Thinking 時設定了較小的 max_tokens,搬到 Haiku 5.5 後可能沒有足夠空間同時容納思考與答案,導致輸出截斷。升級時應按實際工作重新設定上限,而非一律使用最大值。
在 high 或以下 Effort,可用 thinking: {"type": "disabled"} 關閉 Thinking;xhigh 與 max 若關閉 Thinking,則會返回 HTTP 400,應使用 Adaptive Thinking。只在 Prompt 中要求「直接回答」,並不能可靠地阻止內部思考。
官方文件亦提醒,xhigh 的多輪對話有時會把答案寫在 thinking 區塊,最終沒有可見文字。應用程式需要檢查文字輸出是否為空,不能只以請求成功判斷任務完成。
多輪 Agent:改 Effort 時留意快取
在對話頂層更改 Effort 會令現有 Prompt Cache 失效。若希望按回合調整 Effort 並保留快取,可參考 Per-message Effort Beta。
上一篇讀取的 Effort 文件列出 Beta Header mid-conversation-output-config-2026-07-01,並要求配合 Adaptive Thinking。當時文件列出 Claude API 與 Google Cloud 支援 Haiku 5.5,Amazon Bedrock 的支援列表未涵蓋此組合。
使用 Per-message Effort 時,如果 Thinking 已關閉,中途改變 Effort 會觸發 400。這個限制屬於該 Beta 功能,不能泛化成所有 Effort 設定都不可更改。
工具、Structured Outputs 與 Browser Use
官方公告確認,Claude Python 與 TypeScript SDK 正加入 Computer Use 及 Browser Use 的 Beta 支援。Anthropic 認為,Haiku 5.5 的速度、能力與價格組合特別適合這類工作;公告未列出 SDK 最低版本,安裝時應按 SDK 文件確認。
官方 Prompting 指南亦列出以下注意事項:
- Thinking 關閉並要求 JSON 輸出時,模型可能略過必要工具調用。可改用 Adaptive Thinking,或在需要工具的請求中移除
output_config.format,亦可按需求使用tool_choice。 - 長篇編程 Agent 在 low effort 下可能提早结束。文件指出,提升至 medium 可減少約一半提早中斷的情況,但每次嘗試的輸出 token 消耗會增加超過一倍;這是文件中的測試觀察,不代表所有應用都有相同變化。
- low 與 medium 有時會在未作實質檢查前回報程式碼修改完成。開發流程仍應以測試結果驗證完成狀態。
- 用戶中途新增的指示不應混入
tool_result;應作為 user turn,附在最後一個 tool_result 之後。 - 提供搜尋工具時,可在 system prompt 或工具描述加入當前日期。
- 需要持續遵循對話規則時,文件建議在 system prompt 明示規則在整段對話中有效,並評估使用 high effort。
Benchmark:哪些能力提升最明顯?
以下成績已對照官方 PDF 中的 Performance 表格。這些是 Anthropic 公布的評測結果,並非本文獨立測試:
| 評測 | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5:參考值 |
|---|---|---|---|---|
| GDPval-AA v2.1 | 1620 | 735 | 1437 | 1840 |
| AA-Briefcase v1.1 | 1578 | 614 | 1336 | 1824 |
| OSWorld 2.1:離線子集 | 72.4% | 15.7% | 48.9% | 83.9% |
| Humanity’s Last Exam:無工具 | 45.9% | 10.2% | 未列出 | 56.9% |
| Humanity’s Last Exam:有工具 | 57.4% | 18.7% | 未列出 | 64.5% |
| Terminal-Bench 4.0 | 39.2% | 0.0% | 16.4% | 70.6% |
| FrontierCode 1.1:Main | 46.4% | 未列出 | 42.4% | 52.1%;Xhigh |
| Chartography:無工具 | 46.4% | 6.4% | 29.1% | 61.6% |
OSWorld 使用離線子集,Humanity’s Last Exam 分有工具與無工具兩種設定,Chartography 則標明無工具。Sonnet 5.5 的 FrontierCode 成績另標示 Xhigh,不能把整張表理解成所有模型都在相同 Effort 下測試。
官方把 Sonnet 5.5 列作參考,並要求讀者到 System Card 查閱完整評測方法。這份 PDF 沒有收錄 System Card,因此測試框架、其餘 Effort 設定及完整條件仍未在本次本地覆核中確認。
表中的 Haiku 4.5 Terminal-Bench 4.0 成績為 0.0%,只能代表該項測試結果,不能據此概括舊模型完全沒有編程能力。
速度與客戶實測:比較對象要看清楚
Anthropic 在註腳限定「最快」的比較方式:以各模型的標準速度計算,Haiku 5.5 是旗下最快模型,但仍慢於 Opus 的 Fast Mode。公告沒有公布具體每秒 token 吞吐量。
這份 PDF 可核對的客戶引述包括:
- Asana:在 AI Teammates 的評測中,涵蓋錯誤分類、建立專案及搜尋大型專案組合等任務。相較其當時使用的模型,完成任務的延遲減少逾 30%,每個 Agent 回合的推理速度最高提升 2.5 倍。引述没有指明比較模型,因此不能寫成全部數字都以 Haiku 4.5 為基準。
- HubSpot:以模擬 CRM 環境評測模型,Haiku 5.5 在三次測試中平均取得 92.8%,是該公司測試套件當時所見的最高分。對一項辨識過時但含糊紀錄的 CRM 審核任務,HubSpot 表示它完成最快、命中率最高,誤報率亦最低。
以上是客戶在特定工作流程中的觀察,不是適用所有開發者的速度或準確率保證。
何時應改用 Sonnet 5.5 或 Opus 5.5?
官方公告的分工相當清楚:Haiku 5.5 適合範圍較窄的任務,例如內容壓縮、摘要及 Subagent 工作;複雜 Agent 編程則仍以 Sonnet 5.5 或 Opus 5.5 更合適。
PDF 中的 Terminal-Bench 4.0 成本曲線亦呈現這項差異:提高 Haiku 5.5 的 Effort 可以提升得分,但 Sonnet 5.5 在圖中達到更高成績。開發者應同時比較任務成功率與每次完成成本,不能只用 token 單價選模型。

實作上可先讓 Haiku 處理資料整理、初步分類或單一工具工作,再把需要長程規劃、多步修正或較高成功率的部分交給較大型模型。這是按官方模型定位提出的架構建議,仍需以你的任務評測驗證。
安全防護:網絡安全與生物研究有不同限制
官方公告表示,Haiku 5.5 相較 Haiku 4.5,在大部分 alignment 評測中有所改善,包括較少出現行為偏離及較低的濫用配合意願。完整方法與結果仍需參閱 System Card。
網絡安全方面,Haiku 5.5 的防護較 Haiku 4.5 嚴格,但較其他近期模型略為寬鬆。它允許比 Sonnet 5.5 更廣泛的防禦性安全工作,仍會攔截滲透測試及其他較可能被攻擊者使用的技術。
生物研究方面,公告指出 Haiku 5.5 採用與 Sonnet 5、Sonnet 5.5 及 Opus 5 相同的防護安排,允許研究性生物學問題,但限制官方判斷可能造成傷害的請求。涉及更廣泛生物或網絡安全活動的機構,可申請 Life Sciences Verification Program 或 Cyber Verification Program。
對相關產品而言,升級前應測試現有合法工作流程是否會被拒絕,並設計清楚的錯誤處理;不能假設 Haiku 4.5 能完成的請求,在新版一定原樣通過。
由 Haiku 4.5 遷移:需要檢查甚麼?
上一篇整理的官方 Prompting 指南表示,Haiku 4.5 的 Prompt 一般可沿用,但升級涉及 5 項破壞性 API 變更。這份公告 PDF 提供了 Migration Guide 連結,沒有列出完整五項內容,因此以下並非完整遷移清單:
- 模型名稱:改為
claude-haiku-5-5。 - Thinking:按新版 Effort 與 Adaptive Thinking 方式調整,不直接沿用
budget_tokens。 - 輸出預算:重新設定
max_tokens,為思考與答案預留空間。 - 成本:重新量度實際 token 消耗,並檢查 Prompt 是否跨過 100K 計價門檻。
- 工具工作:測試 JSON 輸出、工具調用及長任務是否正常完成。
- 拒絕處理:上一篇文件整理列出
stop_reason: "refusal",以及stop_details.category的 cyber、frontier_llm、bio、general_harms 等類別;客戶端需處理此類回應。 - Fallback:上一篇文件表示 Haiku 5.5 尚未支援 Server-side Fallback Beta;不要只靠原樣重送相同請求處理拒絕。
正式升級前,應閱讀 Haiku 5.5 Migration Guide,並用現有工作集測試成功率、延遲、工具行為與總費用。本文未讀取該指南全文,不會補造其餘破壞性變更。
最小 Python API 範例
以下沿用上一篇根據官方 Effort 文件改寫的 Python SDK 範例,使用公告確認的模型名稱與 medium effort。它不是官方原文範例,亦未實際執行:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-haiku-5-5",
max_tokens=4096,
messages=[
{
"role": "user",
"content": (
"Summarize this support ticket in one sentence: "
"The customer cannot reset their password because "
"the reset email never arrives."
),
}
],
output_config={"effort": "medium"},
)
for block in response.content:
if block.type == "text":
print(block.text)
使用前需按官方 SDK 文件完成安裝及 API 金鑰設定。正式產品亦應處理輸出截斷、沒有文字答案、拒絕回應及 API 錯誤,並按工作量調整輸出預算。
同日更新:Sonnet 快取降價與訂閱 API 額度
官方 PDF 確認,Sonnet 5.5 的快取讀取價即日起由每百萬 tokens US$0.20 降至 US$0.10。Anthropic 表示,由於快取讀取佔不少 Agent 工作的 token 消耗,這令大部分 Agent 任務的運行成本約低 20%;並非所有任務或全部計費項目都直接減價 20%。
Anthropic 同時宣布,本週向 Max 及 Team 訂閱用戶推出每月 Claude Platform API 額度:
| 訂閱方案 | 每月 API 額度 |
|---|---|
| Max 5x | US$100 |
| Max 20x | US$200 |
| Team | 最高 US$500,由團隊用戶共用 |
額度可用於任何 Claude 模型。Team 的最高 US$500 是團隊共用額度,並非每名成員各有 US$500;公告亦只表示「本週推出」,不能據此判定每個帳戶已即時收到。領取方式與其他條件可查閱 官方 Help Center 說明。
資料來源:
Anthropic 官方發布公告、
Claude Models Overview、
Effort 文件、
Migration Guide、
Browser Use SDK 文件




