Google DeepMind

Gemini 3.1 Pro Preview

Type
modèle de langue
Contexte
1 049K tokens
Sortie maximale
66K
Sortie le
19 février 2026
Connaissances jusqu'à
février 2026
Chaîne pour l'API
gemini/gemini-3.1-pro-preview

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
vivgrid $2 $12 31 juil. 2026
daoxe $2 $12 31 juil. 2026
frogbot $2 $12 31 juil. 2026
auriko $2 $12 31 juil. 2026
ofox $2 $12 31 juil. 2026
perplexity-agent $2 $12 31 juil. 2026
AIHubMix $2 $12 31 juil. 2026
Abacus.AI $2 $12 31 juil. 2026
CrossModel $2 $12 31 juil. 2026
FastRouter $2 $12 31 juil. 2026
GitHub Copilot $2 $12 31 juil. 2026
Google DeepMind $2 $12 31 juil. 2026
Google Vertex AI $2 $12 31 juil. 2026
Kilo Code $2 $12 31 juil. 2026
LLM Gateway $2 $12 31 juil. 2026
Merge Gateway $2 $12 31 juil. 2026
NanoGPT $2 $12 31 juil. 2026
OpenRouter $2 $12 31 juil. 2026
Vercel $2 $12 31 juil. 2026
ZenMux $2 $12 31 juil. 2026
Venice AI $2,5 $15 31 juil. 2026
OrcaRouter $4 $18 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score en russe 1 495,77 1 488–1 503
Arena Score, mathématiques 1 489,07 1 480–1 498
Arena Score en français 1 488,01 1 474–1 502
Arena Score, questions d'expert 1 486,42 1 479–1 494
Arena Score, requêtes difficiles 1 484,41 1 480–1 489
Arena Score, programmation 1 483,89 1 479–1 489
Arena Score, dialogue à plusieurs tours 1 482,41 1 476–1 489
Arena Score, requêtes longues 1 482,3 1 477–1 487
Arena Score, écriture créative 1 481,61 1 475–1 488
Arena Score en espagnol 1 479,93 1 467–1 493
Arena Score, classement général 1 479,46 1 476–1 483
Arena Score en anglais 1 478,03 1 474–1 483
Arena Score, respect des consignes 1 467,43 1 462–1 473
Arena Score, développement web 1 446,83 1 441–1 452
Arena Score, compréhension de schémas 1 312,53 1 305–1 320
Arena Score, reconnaissance de texte sur image 1 305,79 1 300–1 311
Arena Score, travail sur images 1 295,15 1 289–1 301
ARC-AGI — généralisation à des motifs inédits 98 % · avec un harnais ajusté ARC Prize Leaderboard
Mock AIME 2024–2025 — problèmes d'olympiade 95,6 % · avec un harnais ajusté Epoch evaluations
GPQA Diamond — questions de niveau doctorat 92,13 % · avec un harnais ajusté Epoch evaluations
Terminal-Bench — travail en ligne de commande 80,2 % · avec un harnais ajusté https://www.tbench.ai/leaderboard/terminal-bench/2.0
SimpleQA Verified — exactitude factuelle 77,3 % Epoch evaluations
ARC-AGI-2 77,1 %
SimpleBench — questions pièges 75,52 % SimpleBench Leaderboard
WeirdML — tâches d'apprentissage automatique inhabituelles 72,1 % WeirdML Leaderboard
FrontierMath, niveaux 1–3 59,65 % Epoch evaluations
BALROG — environnements de jeu 57 % Balrog Leaderboard
Problèmes d'échecs 52,65 % Epoch evaluations
Humanity’s Last Exam — questions d'expert 43,74 %
APEX-Agents 33,5 %
FrontierMath, niveau 4 — problèmes de recherche 26,83 % Epoch evaluations
GSO-Bench — optimisation de code 22,55 % https://gso-bench.github.io/index.html
CritPt — problèmes de physique 17,71 %
Arena Score, tâches d'agent -0,01 0–0