LLM InsightsEnglish
GoogleTextVisionAudio

gemini-3.5-flash

gemini-3.5-flash 是 Google 的模型,輸入價格 $1.50、輸出價格 $9.00(每 100 萬 token),上下文視窗 1049K。以輸入 3:輸出 1 的常見混合用量換算,綜合單價約 $3.38/1M token,在本站追蹤的 89 個模型中屬於高價位區間,比其中 28% 的模型便宜。

模型概覽
上下文視窗1049K
輸入價格$1.5 / 1M
輸出價格$9 / 1M
輸出速度190 tok/s
品質分數86
資料更新Updated Aug 2026
價格驗證2026-08-19 · 官方
價格備註Batch 與 Flex 模式為 5 折($0.75/$4.50),快取命中的輸入為 $0.15/1M token

在價格排序上,gemini-3.5-flash 的輸入價格排第 59/89 便宜,輸出價格排第 65/89 便宜。品質分數 86 分,排名第 45/89;以「品質分數 ÷ 輸出價格」計算的 CP 值排名第 59/89。綜合單價高於全站平均 10%。

換成實際帳單:一個每月 50,000 次對話的客服機器人(每次 2,000 輸入 / 500 輸出 token)用 gemini-3.5-flash 大約是每月 $375;改成每月 20,000 次查詢的 RAG 文件問答(每次 8,000 輸入 / 800 輸出 token)則約 $384。因為輸出價格是輸入的 6.0 倍,輸出越長的任務,成本上升得越快——長篇生成請特別留意輸出 token 的控制。

1049K 的上下文視窗約可容納 1,399 頁 A4 文件(以每頁約 750 token 估算),在全站排名第 8/89。足以一次塞入整份技術文件或多個原始碼檔案,適合長文件摘要與大型 codebase 分析。 輸出速度約 190 tok/s(第 13/89 快),適合即時互動與高吞吐批次。

Google 在本站共收錄 8 個模型,gemini-3.5-flash 的綜合單價高於該供應商平均 57%。如果你的任務對品質容忍度較高,Hunyuan HY3(Tencent)綜合單價便宜約 97%,品質分數 87,值得先跑一輪比較。 反過來,如果要更高的品質上限,qwen3.5 的品質分數為 91,綜合單價便宜約 97%。

Google 陣容中與 gemini-3.5-flash 最接近的是 gemini-2.5-pro(輸入 $1.25/輸出 $10.00,品質 93)。相較之下 gemini-3.5-flash 品質分數低 7 分、輸出速度快 125 tok/s(約 192%)、綜合單價便宜 2%。兩者價位相近時,差異主要落在品質上限,建議直接用你的實際 prompt 各跑一輪再決定。

我們的看法

叫 Flash,輸出卻要 $9——這顆模型真正的折扣不在表定價,在計費模式裡。

$1.50 進、$9.00 出:一個違反直覺的比例

gemini-3.5-flash 的輸入輸出比是 1:6。多數同級模型的比例落在 1:2 到 1:5 之間,Flash 系列給人的印象又是「便宜快速」,所以第一眼看到 $9 的輸出價通常會覺得標錯了。

它沒有標錯,而是反映了一件事:這顆模型被設計成消化大量輸入、產出精簡結果。190 tokens/秒的速度加上 1,049K 上下文與 Text/Vision/Audio 三模態,指向的是影音轉寫摘要、長文件萃取、多模態分類這類工作——輸入巨大、輸出只有幾百 token。在那個形狀下,$9 的輸出價根本不是帳單主體。

真正的價格在 Batch、Flex 與快取三個地方

Google 為這顆模型提供 Batch 與 Flex 模式,兩者都是表定價的五折——$0.75/$4.50。快取命中的輸入更便宜,$0.15/1M token,是表定價的十分之一。

這代表你付多少錢,主要取決於工作負載能不能容忍非同步與重複前綴,而不是取決於模型選擇。一條可以走 Batch 又有穩定 system prompt 的管線,實際成本會遠低於比價表上那兩個數字。反過來,即時、單次、每次前綴都不同的請求,就得照表定價付——比價時把這件事算進去,結論常常會翻轉。

先確認你不是該用 gemini-2.5-flash

同一家的 gemini-2.5-flash 是 $0.30/$2.50、品質 84。gemini-3.5-flash 是 $1.50/$9.00、品質 86。輸入貴 5 倍、輸出貴 3.6 倍,換 2 分品質。除非你確實需要 1,049K 上下文(2.5-flash 沒有)或音訊模態,否則這個升級很難算得過來。

跨供應商看,claude-haiku-4-5($1/$5、180 tokens/秒、品質 82)在純文字的即時場景更便宜;要多模態且預算緊,gpt-5.6-luna($0.20/$1.20、品質 90、同樣三模態)幾乎在每一格都更好。gemini-3.5-flash 真正不可取代的是「Google 生態內、需要百萬上下文的多模態高速處理」——如果你不在這個交集裡,先去看那兩顆。

實際月費估算

以四種常見工作負載估算每月 API 費用,並與本站目前最便宜的模型對照。

使用情境用量假設本模型月費全站最便宜模型
客服聊天機器人每次 2,000 輸入 / 500 輸出 token,每月 50,000 次對話$375$3.00
RAG 文件問答每次 8,000 輸入 / 800 輸出 token,每月 20,000 次查詢$384$3.84
程式開發助理每次 12,000 輸入 / 2,000 輸出 token,每月 10,000 次請求$360$3.20
批次摘要 / 分類每次 4,000 輸入 / 400 輸出 token,每月 200,000 筆$1,920$19

以本頁列出的單價直接換算,未計入提示快取、批次折扣或免費額度。

與其他模型比較

同一份資料下最值得一起評估的替代方案。

模型供應商綜合單價 /1M品質價差
gemini-3.5-flashGoogle$3.3886—
Hunyuan HY3更便宜的選擇Tencent$0.1087-97%
qwen3.5更高品質Alibaba$0.1191-97%
gemini-2.5-pro同供應商Google$3.4493+2%
qwen3.7-flash全站 CP 值王Alibaba$0.05582-98%

適合用途

聊天對話快速回應多模態

支援模態

TextVisionAudio

適合與不適合的情境

適合

  • 聊天與客服:多輪對話、語氣自然,適合面向使用者的產品。
  • 長文件處理:1049K 視窗可一次讀入整份合約、論文或大型 codebase。
  • 高吞吐與即時互動:190 tok/s 的輸出速度讓串流回應幾乎無感延遲。
  • 多模態輸入:可直接處理圖片、截圖與文件掃描檔。

較不適合

  • 高頻批次處理:綜合單價 $3.38/1M token 屬於高價位,量大時帳單成長很快。

常見問題

gemini-3.5-flash 的 API 價格是多少?

gemini-3.5-flash 的輸入價格是每 100 萬 token $1.50,輸出價格是每 100 萬 token $9.00。以輸入 3:輸出 1 的混合用量換算,綜合單價約 $3.38/1M token。

用 gemini-3.5-flash 每月大概要花多少錢?

取決於用量。以本頁的四個情境估算:客服機器人約 $375/月、RAG 文件問答約 $384/月、程式開發助理約 $360/月、批次摘要約 $1,920/月。你可以用成本計算機帶入自己的 token 用量重新估算。

gemini-3.5-flash 的上下文視窗有多大?

1049K token,約等於 1,399 頁 A4 文件(以每頁約 750 token 估算),在本站追蹤的 89 個模型中排名第 8。

gemini-3.5-flash 和 Hunyuan HY3 哪個划算?

Hunyuan HY3 的綜合單價約 $0.10/1M token,比 gemini-3.5-flash 的 $3.38 便宜約 97%;品質分數為 87(gemini-3.5-flash 為 86)。若品質差距在你的任務上不明顯,選便宜的那個;差距明顯就選 gemini-3.5-flash。建議用自己的資料各跑一輪再決定。

gemini-3.5-flash 適合哪些應用場景?

本站標記的適用情境為:聊天對話、快速回應、多模態。聊天與客服:多輪對話、語氣自然,適合面向使用者的產品。 較不適合的情況:高頻批次處理:綜合單價 $3.38/1M token 屬於高價位,量大時帳單成長很快。

gemini-3.5-flash 的價格資料多久更新一次?

本頁價格最後於 2026-08-19 核對,來源為官方文件。llmprice.app 每日執行價格收集流程,但供應商調價後仍可能有落差,正式導入前請再確認 Google 官方定價頁。

估算這個模型的實際成本

將單次 token 用量與每月請求次數帶入計算器,比較不同模型的總成本。

開啟成本計算器

同類模型

依供應商與使用情境延伸探索。

Google

gemini-3.1-flash-lite

輸入價格$0.25
輸出價格$1.5
查看模型
Google

gemini-2.5-flash

輸入價格$0.3
輸出價格$2.5
查看模型
Google

gemini-3.6-flash

輸入價格$0.75
輸出價格$3.75
查看模型

價格、速度與品質分數會隨供應商更新;正式採用前請再次確認官方文件。