Anthropic 於 2026 年 10 月 7 日推出 Claude Haiku 5.5,主打大量、短任務與低延遲應用。在 Claude API,提示長度不超過 100,000 tokens 時,每百萬輸入 tokens 為 0.10 美元、輸出為 0.50 美元;超過這個提示長度,兩項費率分別提高至 0.50 與 2.50 美元。這條分界,是評估新模型成本時要先看的條件。資料來源:Haiku 5.5 官方規格
同日公告還包含 Max、Team 訂閱者的每月 API 抵用額,以及 Sonnet 5.5 快取讀取降價。對台灣開發者與中小團隊,值得評估的是一般客服分流、商品資料整理、摘要和小型代理工作;真正成本仍包含 token 計數、失敗重試與人工複核。本文以台北時間 10 月 8 日整理官方資料,沒有進行帳戶、帳單或效能實測。
Haiku 5.5 API 價格怎麼算?先看 10 萬 tokens 分界
Haiku 5.5 依一次請求的完整提示 token 長度採用不同費率,判斷基準是 tokens,並非中文字數。1M tokens 的上下文容量也不代表整個容量都使用最低單價。下表為官方基本費率,單位都是美元/每百萬 tokens。資料來源:Claude API 價格文件
| 計費項目 | 提示 ≤100,000 tokens | 提示 >100,000 tokens |
|---|---|---|
| 一般輸入 | US$0.10 | US$0.50 |
| 輸出 | US$0.50 | US$2.50 |
| 快取讀取 | US$0.01 | US$0.05 |
| 5 分鐘快取寫入 | US$0.125 | US$0.625 |
| 1 小時快取寫入 | US$0.20 | US$1.00 |
Batch API 的輸入、輸出費率有 50% 折扣。資料駐留、工具與不同雲端平台的適用費用仍要另核;不能把表中的一般輸入單價當成整個工作流的總成本。查看 Batch、區域處理與工具計費說明
官方「平均便宜約 75%」不等於每個請求都省 75%
Anthropic 宣稱,Haiku 5.5 相較 Haiku 4.5 平均執行成本約低 75%。其註腳分別列出:提示不超過 100,000 tokens 的單價低 90%,超過者低 50%,並將新版 token 計數差異納入估算。這是廠商依工作負載推估的結果,不能直接套用到每個台灣團隊的帳單。資料來源:發布公告與定價註腳
官方遷移文件指出,相同文字用 Haiku 5.5 的新版 tokenizer 計算,約比 Haiku 4.5 多 30% tokens,實際增加量取決於內容。搬移提示時應用新模型重新計數,尤其要檢查接近 10 萬 tokens 的長文件。原本設定的輸出上限,也可能容納不了相同長度的回答。查看 token 重新計數與遷移說明
新能力與遷移限制:不只是換一個模型 ID
Claude API 的新模型 ID 為 claude-haiku-5-5。Haiku 5.5 支援文字與圖片輸入、文字輸出,提供 1M tokens 上下文,一般 API 最高輸出為 128k tokens,並新增可調整 effort 的 adaptive thinking;預設 effort 為 medium。它適合先從分類、摘要、資料擷取與代理中的小任務測起。查看模型規格與可用平台
原本呼叫 Haiku 4.5 的程式應先檢查以下幾點。官方另列有完整清單,包含 computer use 工具更換與 thinking blocks 的回傳限制,不能只替換模型 ID 就視為遷移完成。資料來源:Haiku 5.5 migration guide
- 思考設定改變:舊式
thinking.type=enabled搭配budget_tokens會出錯,應改依 adaptive thinking 與 effort 文件調整。 - 採樣參數與預填回答:官方建議移除
temperature、top_p、top_k;不相容設定可能回傳 400。以 assistant 訊息預填回答的舊寫法也不再支援。 - 解析回覆:回傳可能先出現 thinking block,應依區塊 type 找文字;thinking tokens 也計入
max_tokens,太小的上限可能讓文字回答尚未產生就停止。 - 例外處理:程式需處理
stop_reason: refusal。拒答或輸出不完整都不應默認為任務成功。
若也在維護其他 Claude 模型的代理,可延伸閱讀 Claude Fable 5.1 的價格與 API Agent 遷移重點;不同模型的參數限制與費率仍須分別核對。
Haiku 4.5 目前仍列為 Active。官方所列「不早於 2026 年 10 月 15 日」是最早退休時間的界線,不是已宣布 10 月 15 日停用;各雲端供應商的生命週期也可能不同。查看官方模型生命週期
Max、Team 每月 API 抵用額:額度、資格與帳單邊界
Anthropic 宣布本週逐步提供每月 Claude Platform API 抵用額。這項權益適用 Max 與 Team,包括符合條件的折扣 Team 方案;Free、Pro、Enterprise 不在適用清單內。資料來源:每月 API credits 官方說明
| 訂閱方案 | 每月額度 | 範圍 |
|---|---|---|
| Max 5x | US$100 | 連結的 Console 組織 |
| Max 20x | US$200 | 連結的 Console 組織 |
| Team | Standard 每席 US$20;Premium 每席 US$100 | 全隊合池,最高 US$500/月 |
訂閱須有效且滿七天,並由符合資格的訂閱者或 Team 擁有者,連結自己具備 Owner、Admin 或 Billing 權限的 Console 組織。月繳方案按帳期發放,年繳方案仍每月發放,未用完不累積。額度可用於 Claude Console 組織內的 API 等支援服務,不能抵互動式 Claude Code、Claude/Cowork 額外用量,或 Claude Platform on AWS、Bedrock、Google Cloud、Foundry 費用。查看適用平台與發放規則
有抵用額,也可能觸發已設定的自動儲值。官方說明指出,auto-reload 依「已購額度」餘額門檻運作,即使贈送抵用額還沒用完,也可能自動儲值。抵用額耗盡後,有其他付費額度者會繼續消耗;一般預付組織沒有任何餘額時,API 請求會因餘額不足而停止。採 Anthropic 業務合約帳單的組織,超出抵用額的用量仍照常計費。資料來源:額度抵扣與自動儲值規則
領取時需核對連結的 Console 組織、使用該餘額的人員與計費設定,並閱讀方案條款;每個訂閱只能連結一個組織,更換須聯絡支援。抵用額不會提高 Claude、Claude Code 或 Cowork 的訂閱用量上限,也不會取消組織既有的 API 速率或支出限制。
如果你主要想用 Claude 協助寫程式,可另看 Cursor 與 Claude Code 的使用方式及計費比較,先分清互動式工具訂閱和自建 API 工作流,再判斷這次抵用額是否適用。
Sonnet 5.5 快取降價已宣布,官方文件仍有不一致
10 月 7 日發布公告宣布,Sonnet 5.5 快取讀取費率由每百萬 tokens 0.20 美元降至 0.10 美元。查核時,價格頁的快取說明也列出 0.10 美元,但同頁主表與 Sonnet 5.5 規格頁仍顯示 0.20 美元。
因此,目前可確認的是 Anthropic 已正式宣布降價。本文沒有驗證個別 endpoint、合約或帳單實際採用的費率,也不把「多數代理工作約便宜 20%」當成固定節省比例。若你的成本主要來自 Sonnet 快取,應先確認適用平台與計費紀錄,再更新內部預算。
台灣能用嗎?先確認平台,再測自己的繁中任務
官方列出 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundry 等供應平台;一般 API 支援地區包含 Taiwan。這不等於每個雲區域、Claude app 方案或個別帳戶的模型選單都已核實可用。查看支援地區;查看模型供應平台。
AI-XBlog 的判斷:Haiku 5.5 最值得先驗證的,是每天反覆執行、結果能清楚驗收的小任務。台灣電商可先用歷史客服訊息測「物流、商品、退換貨」分流;內容團隊可測商品欄位整理或摘要。測試資料應包含繁中與英文混用、型號、台灣用語及資訊不完整的情況,並拿既有流程作比較。
第一輪評估應同時記錄正確完成率、人工修改次數、拒答、延遲,以及含重試的每件驗收成本。長文件團隊則要先重算 token,觀察有多少請求跨過 10 萬分界。提示精簡與文件檢索可能降低輸入量,但如果刪掉必要上下文、增加誤判,便失去省費意義。
已經有穩定規則可完成的工作,可以繼續保留規則;需要長程推理、跨檔修改或高複雜度代理協作的任務,則應與 Sonnet/Opus 分別評估。不要僅因取得 API 抵用額就擴大部署,抵用額到期後的常態成本,才是能否長期採用的重要條件。
會改變本文判斷的證據,包括官方修正價格與供應範圍、快取降價文件完成同步,以及相同繁中任務中可重現的品質、耗時與帳單結果。現階段,先把一個低風險任務測清楚,比一次更換全部代理更有用。
下一步:用 官方遷移清單核對現有請求參數,再依 提示長度費率估算一批代表性任務;有 Max/Team 方案者,另讀 抵用額資格與計費說明。是否擴大使用,應由任務驗收結果決定。
查核時間:2026 年 10 月 7 日 19:00–19:24 UTC(台北時間 2026 年 10 月 8 日 03:00–03:24);官方發布日期為 10 月 7 日。本文依官方公告與文件整理,例示為編輯分析;未呼叫模型、測試帳戶權限、跑 benchmark 或核對實際帳單。
封面:AI-XBlog 製作的 AI 生成概念插畫,示意資料分流與不同工作量;非 Anthropic 官方圖片、介面或模型測試結果。

