Gemini 3.1 Flash API Pricing — $0.75/M input, $4.50/M output
The ultimate balance of speed and multimodal intelligence.
Legacy — superseded by Gemini 3.6 Flash See Gemini 3.6 Flash pricing.
No announced shutdown date. Source · Full retirement tracker
Speed
Not yet measured — see the speed benchmark leaderboard for models we do track.
Cost at scale
| Tokens / month | Est. cost (blended 3:1) |
|---|---|
| 100,000 | $0.17 |
| 1,000,000 | $1.69 |
| 10,000,000 | $16.88 |
| 100,000,000 | $168.75 |
How Gemini 3.1 Flash compares
Gemini 2.5 Flash Lite — $0.18/MGemini 3.5 Flash Lite — $0.56/MGemini 3.1 Flash Lite — $0.56/MGemini 2.5 Flash — $0.85/MGemini 3.6 Flash — $3.38/MGPT-5.4 Mini — $1.69/MGrok 4.3 — $1.56/Mo3-Mini — $1.93/M
FAQ
Is Gemini 3.1 Flash cheaper than GPT-5.4 Mini?
Gemini 3.1 Flash costs $1.69/M blended tokens, GPT-5.4 Mini costs $1.69/M — GPT-5.4 Mini is cheaper.
How much does 1 million tokens cost with Gemini 3.1 Flash?
At a 3:1 input:output ratio, 1 million blended tokens costs approximately $1.69. Pure input costs $0.75/M; pure output costs $4.50/M.
Who provides Gemini 3.1 Flash?
Gemini 3.1 Flash is served by Google. Pricing was last verified on 2026-04-06 against https://ai.google.dev/gemini-api/docs/pricing.
