Google DeepMind

Gemini 3 Flash Preview

Type
modèle de langue
Contexte
1 049K tokens
Sortie maximale
66K
Sortie le
17 décembre 2025
Connaissances jusqu'à
janvier 2025
Chaîne pour l'API
google/gemini-3-flash-preview

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
qihang-ai $0,07 $0,43 31 juil. 2026
frogbot $0,5 $3 31 juil. 2026
perplexity-agent $0,5 $3 31 juil. 2026
gmi $0,5 $3 31 juil. 2026
302.AI $0,5 $3 31 juil. 2026
AIHubMix $0,5 $3 31 juil. 2026
Abacus.AI $0,5 $3 31 juil. 2026
CrossModel $0,5 $3 31 juil. 2026
GitHub Copilot $0,5 $3 31 juil. 2026
Google DeepMind $0,5 $3 31 juil. 2026
Google Vertex AI $0,5 $3 31 juil. 2026
Jiekou.AI $0,5 $3 31 juil. 2026
Kilo Code $0,5 $3 31 juil. 2026
LLM Gateway $0,5 $3 31 juil. 2026
Merge Gateway $0,5 $3 31 juil. 2026
NanoGPT $0,5 $3 31 juil. 2026
OpenRouter $0,5 $3 31 juil. 2026
OrcaRouter $0,5 $3 31 juil. 2026
Requesty $0,5 $3 31 juil. 2026
ZenMux $0,5 $3 31 juil. 2026
Venice AI $0,7 $3,75 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Mock AIME 2024–2025 — problèmes d'olympiade 92,77 % · avec un harnais ajusté Epoch evaluations
GeoBench — localisation d'un lieu à partir d'une photo 88 % GeoBench leaderboard
GPQA Diamond — questions de niveau doctorat 77,61 % · avec un harnais ajusté Epoch evaluations
SWE-bench Verified — correction de bugs dans des dépôts 75,41 % · avec un harnais ajusté Epoch evaluations
SimpleQA Verified — exactitude factuelle 67,4 % Epoch evaluations
Terminal-Bench — travail en ligne de commande 64,3 % · avec un harnais ajusté Terminal-Bench v2 Leaderboard
WeirdML — tâches d'apprentissage automatique inhabituelles 61,6 % WeirdML Leaderboard
SimpleBench — questions pièges 53,32 % SimpleBench Leaderboard
FrontierMath, niveaux 1–3 51,23 % Epoch evaluations
BALROG — environnements de jeu 48,1 % Balrog Leaderboard
Problèmes d'échecs 34,76 % Epoch evaluations
ARC-AGI-2 33,61 %
APEX-Agents 24 %
ARC-AGI — généralisation à des motifs inédits 21,5 % · avec un harnais ajusté
FrontierMath, niveau 4 — problèmes de recherche 17,07 % Epoch evaluations
GSO-Bench — optimisation de code 9,8 % GSO Leaderboard