在價格排序上,claude-haiku-4-5 的輸入價格排第 51/89 便宜,輸出價格排第 57/89 便宜。品質分數 82 分,排名第 56/89;以「品質分數 ÷ 輸出價格」計算的 CP 值排名第 52/89。綜合單價低於全站平均 35%。
換成實際帳單:一個每月 50,000 次對話的客服機器人(每次 2,000 輸入 / 500 輸出 token)用 claude-haiku-4-5 大約是每月 $225;改成每月 20,000 次查詢的 RAG 文件問答(每次 8,000 輸入 / 800 輸出 token)則約 $240。因為輸出價格是輸入的 5.0 倍,輸出越長的任務,成本上升得越快——長篇生成請特別留意輸出 token 的控制。
200K 的上下文視窗約可容納 267 頁 A4 文件(以每頁約 750 token 估算),在全站排名第 65/89。適合一般 RAG 與多輪對話,但整本手冊等超長輸入仍建議先做檢索切塊。 輸出速度約 180 tok/s(第 15/89 快),適合即時互動與高吞吐批次。
Anthropic 在本站共收錄 12 個模型,claude-haiku-4-5 的綜合單價低於該供應商平均 79%。如果你的任務對品質容忍度較高,qwen3.7-flash(Alibaba)綜合單價便宜約 97%,品質分數 82,值得先跑一輪比較。 反過來,如果要更高的品質上限,Hunyuan HY3 的品質分數為 87,綜合單價便宜約 95%。
Anthropic 陣容中與 claude-haiku-4-5 最接近的是 claude-haiku-5.5(輸入 $0.10/輸出 $0.50,品質 —)。相較之下 claude-haiku-4-5 品質分數高 82 分、上下文視窗小 800K、綜合單價貴 90%。兩者價位相近時,差異主要落在品質上限,建議直接用你的實際 prompt 各跑一輪再決定。
我們的看法
180 tokens/秒 是它最有力的數字,但它的價格已經跟不上同速度級距的對手。
速度才是這顆模型的產品定位
claude-haiku-4-5 的輸出速度是 180 tokens/秒,落在目錄的快速一端,和 deepseek-v4-flash 與 InclusionAI Ling-3.0-flash 同級(純吞吐的冠軍另有其人,Groq 上的 llama-3.3-70b-versatile 是 300)。品質 82、200K 上下文、Text 與 Vision。它被設計來做的事很明確:即時互動——自動完成、行內建議、串流客服回覆、分類與路由。
在這些場景裡,第一個 token 出現的時間比第 500 個 token 的品質重要得多。使用者感受到的是延遲,不是基準分數。
同一個速度帶裡的價格現實
問題出在同級距的價格。Ling-3.0-flash 是 $0.07/$0.22、180 tokens/秒、品質 80、上下文 262K;haiku-4-5 是 $1/$5,輸入貴 14 倍、輸出貴 23 倍,品質只高 2 分,上下文還少了四分之一。deepseek-v4-flash 是 $0.14/$0.28、180 tokens/秒、品質 88,同樣遠低於 haiku 的價格而分數更高。
同門比較也不輕鬆:claude-sonnet-5 是 $2/$10、品質 92、95 tokens/秒。haiku 只便宜一半,卻少了 10 分品質。這讓 haiku 落在一個很窄的縫裡——不夠便宜到當大量批次的主力,也不夠強到當主要推理模型。
它仍然說得通的三個理由
第一,你已經在 Anthropic 上。同一組 API 金鑰、同一套 SDK、同樣的工具使用格式與安全行為,混用 haiku 與 Sonnet 5 不需要維護第二條整合路徑,這個省下的複雜度有實際價值。
第二,資料落地與合規。企業採購常常已經完成對單一供應商的審查,多引進一家供應商的行政成本可能超過帳單差額。第三,200K 上下文對即時任務其實綽綽有餘——多數自動完成與客服場景根本用不到 100 萬 token。如果這三點都不成立,先看 deepseek-v4-flash 與 Ling-3.0-flash,再回頭決定要不要付這個溢價。
實際月費估算
以四種常見工作負載估算每月 API 費用,並與本站目前最便宜的模型對照。
| 使用情境 | 用量假設 | 本模型月費 | 全站最便宜模型 |
|---|---|---|---|
| 客服聊天機器人 | 每次 2,000 輸入 / 500 輸出 token,每月 50,000 次對話 | $225 | $3.00 |
| RAG 文件問答 | 每次 8,000 輸入 / 800 輸出 token,每月 20,000 次查詢 | $240 | $3.84 |
| 程式開發助理 | 每次 12,000 輸入 / 2,000 輸出 token,每月 10,000 次請求 | $220 | $3.20 |
| 批次摘要 / 分類 | 每次 4,000 輸入 / 400 輸出 token,每月 200,000 筆 | $1,200 | $19 |
以本頁列出的單價直接換算,未計入提示快取、批次折扣或免費額度。
與其他模型比較
同一份資料下最值得一起評估的替代方案。
| 模型 | 供應商 | 綜合單價 /1M | 品質 | 價差 |
|---|---|---|---|---|
| claude-haiku-4-5 | Anthropic | $2.00 | 82 | — |
| qwen3.7-flash更便宜的選擇 | Alibaba | $0.055 | 82 | -97% |
| Hunyuan HY3更高品質 | Tencent | $0.10 | 87 | -95% |
| claude-haiku-5.5同供應商 | Anthropic | $0.20 | — | -90% |
適合用途
支援模態
適合與不適合的情境
適合
- 聊天與客服:多輪對話、語氣自然,適合面向使用者的產品。
- 高吞吐與即時互動:180 tok/s 的輸出速度讓串流回應幾乎無感延遲。
- 多模態輸入:可直接處理圖片、截圖與文件掃描檔。
較不適合
- 沒有明顯的排除情境;仍建議在正式導入前,用你自己的資料跑一次基準測試。
常見問題
claude-haiku-4-5 的 API 價格是多少?
claude-haiku-4-5 的輸入價格是每 100 萬 token $1.00,輸出價格是每 100 萬 token $5.00。以輸入 3:輸出 1 的混合用量換算,綜合單價約 $2.00/1M token。
用 claude-haiku-4-5 每月大概要花多少錢?
取決於用量。以本頁的四個情境估算:客服機器人約 $225/月、RAG 文件問答約 $240/月、程式開發助理約 $220/月、批次摘要約 $1,200/月。你可以用成本計算機帶入自己的 token 用量重新估算。
claude-haiku-4-5 的上下文視窗有多大?
200K token,約等於 267 頁 A4 文件(以每頁約 750 token 估算),在本站追蹤的 89 個模型中排名第 65。
claude-haiku-4-5 和 qwen3.7-flash 哪個划算?
qwen3.7-flash 的綜合單價約 $0.055/1M token,比 claude-haiku-4-5 的 $2.00 便宜約 97%;品質分數為 82(claude-haiku-4-5 為 82)。若品質差距在你的任務上不明顯,選便宜的那個;差距明顯就選 claude-haiku-4-5。建議用自己的資料各跑一輪再決定。
claude-haiku-4-5 適合哪些應用場景?
本站標記的適用情境為:聊天對話、經濟實惠、快速回應。聊天與客服:多輪對話、語氣自然,適合面向使用者的產品。 較不適合的情況:沒有明顯的排除情境;仍建議在正式導入前,用你自己的資料跑一次基準測試。
claude-haiku-4-5 的價格資料多久更新一次?
本頁價格最後於 2026-08-19 核對,來源為官方文件。llmprice.app 每日執行價格收集流程,但供應商調價後仍可能有落差,正式導入前請再確認 Anthropic 官方定價頁。
估算這個模型的實際成本
將單次 token 用量與每月請求次數帶入計算器,比較不同模型的總成本。
同類模型
依供應商與使用情境延伸探索。
價格、速度與品質分數會隨供應商更新;正式採用前請再次確認官方文件。