在價格排序上,gpt-4o-mini 的輸入價格排第 19/89 便宜,輸出價格排第 22/89 便宜。品質分數 80 分,排名第 61/89;以「品質分數 ÷ 輸出價格」計算的 CP 值排名第 20/89。綜合單價低於全站平均 91%。
換成實際帳單:一個每月 50,000 次對話的客服機器人(每次 2,000 輸入 / 500 輸出 token)用 gpt-4o-mini 大約是每月 $30;改成每月 20,000 次查詢的 RAG 文件問答(每次 8,000 輸入 / 800 輸出 token)則約 $34。因為輸出價格是輸入的 4.0 倍,輸出越長的任務,成本上升得越快——長篇生成請特別留意輸出 token 的控制。
128K 的上下文視窗約可容納 171 頁 A4 文件(以每頁約 750 token 估算),在全站排名第 74/89。適合一般 RAG 與多輪對話,但整本手冊等超長輸入仍建議先做檢索切塊。 輸出速度約 160 tok/s(第 21/89 快),適合即時互動與高吞吐批次。
OpenAI 在本站共收錄 15 個模型,gpt-4o-mini 的綜合單價低於該供應商平均 94%。如果你的任務對品質容忍度較高,qwen3.7-flash(Alibaba)綜合單價便宜約 79%,品質分數 82,值得先跑一輪比較。 反過來,如果要更高的品質上限,mercury-2.5-preview 的品質分數為 82,綜合單價便宜約 74%。
OpenAI 陣容中與 gpt-4o-mini 最接近的是 gpt-6-luna(輸入 $0.10/輸出 $0.50,品質 —)。相較之下 gpt-4o-mini 品質分數高 80 分、上下文視窗小 922K、綜合單價貴 24%。兩者價位相近時,差異主要落在品質上限,建議直接用你的實際 prompt 各跑一輪再決定。
我們的看法
還在服役的產線主力,但它的價格優勢已經比多數人以為的小很多。
它仍然是很多系統的預設值,而這值得重新檢查
gpt-4o-mini 是 $0.15/$0.60、品質 80、128K 上下文、160 tokens/秒。2024 到 2025 年間它幾乎定義了「平價 API」這個類別,大量教學文、SDK 範例和樣板專案的預設模型都是它,所以到今天仍有非常多線上系統在跑它——多半不是因為評估過,而是因為沒人去動。
以絕對數字看它確實還便宜:綜合單價約 $0.26/1M token。但它便宜的方式在 2026 年已經不特別了。
把它和三個現役對手擺在一起
同門的 gpt-5.6-luna 是 $0.20/$1.20,貴了一點,但品質 90(+10 分)、上下文 1,049K(8 倍),還多了音訊。Alibaba 的 qwen3.5 是 $0.10/$0.15,兩邊都比 4o-mini 更便宜,品質卻是 91。InclusionAI 的 Ling-3.0-flash 是 $0.07/$0.22,同樣更便宜,品質 80 打平,上下文 262K 是兩倍。
換句話說,4o-mini 現在同時被「更便宜且更好」和「稍貴但好很多」兩邊夾住。128K 上下文是它最明顯的短板——在同價位帶已經算偏小的一端。
什麼情況下留著它才是對的
有兩個站得住腳的理由。一是生態:OpenAI 的 SDK、structured outputs、function calling 與周邊工具鏈成熟度仍然領先,換模型的工程成本不是零。二是穩定性——一個跑了一年、prompt 都調校過的系統,換掉底層模型要重跑整套回歸測試,這個成本必須算進去。
但如果你正在開新專案,沒有理由把 4o-mini 設成預設。同一份 prompt 在 qwen3.5 上通常更便宜也更準,在 luna 上則多了 8 倍上下文與音訊。該做的動作很簡單:拿現有的評估集,同時跑這三個模型,比對通過率和帳單。這件事花不到一天,結論通常很明確。
實際月費估算
以四種常見工作負載估算每月 API 費用,並與本站目前最便宜的模型對照。
| 使用情境 | 用量假設 | 本模型月費 | 全站最便宜模型 |
|---|---|---|---|
| 客服聊天機器人 | 每次 2,000 輸入 / 500 輸出 token,每月 50,000 次對話 | $30 | $3.00 |
| RAG 文件問答 | 每次 8,000 輸入 / 800 輸出 token,每月 20,000 次查詢 | $34 | $3.84 |
| 程式開發助理 | 每次 12,000 輸入 / 2,000 輸出 token,每月 10,000 次請求 | $30 | $3.20 |
| 批次摘要 / 分類 | 每次 4,000 輸入 / 400 輸出 token,每月 200,000 筆 | $168 | $19 |
以本頁列出的單價直接換算,未計入提示快取、批次折扣或免費額度。
與其他模型比較
同一份資料下最值得一起評估的替代方案。
| 模型 | 供應商 | 綜合單價 /1M | 品質 | 價差 |
|---|---|---|---|---|
| gpt-4o-mini | OpenAI | $0.26 | 80 | — |
| qwen3.7-flash更便宜的選擇 | Alibaba | $0.055 | 82 | -79% |
| mercury-2.5-preview更高品質 | Inception | $0.068 | 82 | -74% |
| gpt-6-luna同供應商 | OpenAI | $0.20 | — | -24% |
適合用途
支援模態
適合與不適合的情境
適合
- 聊天與客服:多輪對話、語氣自然,適合面向使用者的產品。
- 高吞吐與即時互動:160 tok/s 的輸出速度讓串流回應幾乎無感延遲。
- 大量、成本敏感的批次任務:單價低,適合分類、標註與摘要等高頻工作。
- 多模態輸入:可直接處理圖片、截圖與文件掃描檔。
較不適合
- 高難度推理:品質分數 80 在本站偏低,複雜規劃或數學任務建議選更強的模型。
常見問題
gpt-4o-mini 的 API 價格是多少?
gpt-4o-mini 的輸入價格是每 100 萬 token $0.15,輸出價格是每 100 萬 token $0.60。以輸入 3:輸出 1 的混合用量換算,綜合單價約 $0.26/1M token。
用 gpt-4o-mini 每月大概要花多少錢?
取決於用量。以本頁的四個情境估算:客服機器人約 $30/月、RAG 文件問答約 $34/月、程式開發助理約 $30/月、批次摘要約 $168/月。你可以用成本計算機帶入自己的 token 用量重新估算。
gpt-4o-mini 的上下文視窗有多大?
128K token,約等於 171 頁 A4 文件(以每頁約 750 token 估算),在本站追蹤的 89 個模型中排名第 74。
gpt-4o-mini 和 qwen3.7-flash 哪個划算?
qwen3.7-flash 的綜合單價約 $0.055/1M token,比 gpt-4o-mini 的 $0.26 便宜約 79%;品質分數為 82(gpt-4o-mini 為 80)。若品質差距在你的任務上不明顯,選便宜的那個;差距明顯就選 gpt-4o-mini。建議用自己的資料各跑一輪再決定。
gpt-4o-mini 適合哪些應用場景?
本站標記的適用情境為:聊天對話、經濟實惠、快速回應。聊天與客服:多輪對話、語氣自然,適合面向使用者的產品。 較不適合的情況:高難度推理:品質分數 80 在本站偏低,複雜規劃或數學任務建議選更強的模型。
gpt-4o-mini 的價格資料多久更新一次?
本頁價格最後於 2026-08-19 核對,來源為官方文件。llmprice.app 每日執行價格收集流程,但供應商調價後仍可能有落差,正式導入前請再確認 OpenAI 官方定價頁。
估算這個模型的實際成本
將單次 token 用量與每月請求次數帶入計算器,比較不同模型的總成本。
同類模型
依供應商與使用情境延伸探索。
價格、速度與品質分數會隨供應商更新;正式採用前請再次確認官方文件。