Google DeepMind

Gemini 2.5 Pro

Type
modèle de langue
Contexte
1 049K tokens
Sortie maximale
66K
Sortie le
17 juin 2025
Connaissances jusqu'à
janvier 2025
Chaîne pour l'API
google/gemini-2.5-pro

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Poe $0,87 $7 31 juil. 2026
Jiekou.AI $1,125 $9 31 juil. 2026
Databricks databricks/databricks-gemini-2-5-pro $1,25 $10 31 juil. 2026
neon $1,25 $10 31 juil. 2026
frogbot $1,25 $10 31 juil. 2026
auriko $1,25 $10 31 juil. 2026
perplexity-agent $1,25 $10 31 juil. 2026
modelis $1,25 $10 2 août 2026
302.AI $1,25 $10 31 juil. 2026
AIHubMix $1,25 $10 31 juil. 2026
Abacus.AI $1,25 $10 31 juil. 2026
CrossModel $1,25 $10 31 juil. 2026
Databricks databricks-gemini-2-5-pro $1,25 $10 31 juil. 2026
DeepInfra $1,25 $10 31 juil. 2026
FastRouter $1,25 $10 31 juil. 2026
GitHub Copilot $1,25 $10 31 juil. 2026
Google DeepMind $1,25 $10 31 juil. 2026
Google Vertex AI $1,25 $10 31 juil. 2026
Helicone $1,25 $10 31 juil. 2026
Kilo Code $1,25 $10 31 juil. 2026
LLM Gateway $1,25 $10 31 juil. 2026
Merge Gateway $1,25 $10 31 juil. 2026
NEAR AI $1,25 $10 31 juil. 2026
OCI Generative AI $1,25 $10 31 juil. 2026
OpenRouter $1,25 $10 31 juil. 2026
Requesty $1,25 $10 31 juil. 2026
SAP AI Core $1,25 $10 31 juil. 2026
Vercel $1,25 $10 31 juil. 2026
ZenMux $1,25 $10 31 juil. 2026
Cortecs $1,654 $11,024 31 juil. 2026
vercel_ai_gateway $2,5 $10 31 juil. 2026
NanoGPT $2,5 $10 31 juil. 2026
OrcaRouter $2,5 $15 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

Un même fournisseur apparaît plusieurs fois s'il vend ce modèle sous des identifiants différents et à des prix différents — par exemple à des précisions de poids différentes. L'identifiant est indiqué à côté du nom. Les offres identiques arrivées de deux sources sous des orthographes différentes sont fusionnées en une seule ligne.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score en français 1 470,66 1 456–1 485
Arena Score en espagnol 1 469,59 1 457–1 482
Arena Score en russe 1 460,7 1 454–1 467
Arena Score, classement général 1 457,52 1 455–1 460
Arena Score en anglais 1 457,33 1 454–1 461
Arena Score, requêtes difficiles 1 454,97 1 452–1 458
Arena Score, questions d'expert 1 454,85 1 448–1 462
Arena Score, écriture créative 1 454,49 1 449–1 460
Arena Score, programmation 1 452,45 1 448–1 457
Arena Score, dialogue à plusieurs tours 1 452,3 1 448–1 457
Arena Score, mathématiques 1 450,58 1 444–1 458
Arena Score, requêtes longues 1 449,35 1 445–1 453
Arena Score, respect des consignes 1 437,05 1 433–1 441
Arena Score, compréhension de schémas 1 271,93 1 265–1 279
Arena Score, reconnaissance de texte sur image 1 269,27 1 264–1 274
Arena Score, travail sur images 1 261,67 1 257–1 266
Arena Score, développement web 1 224,23 1 208–1 240
Mock AIME 2024–2025 — problèmes d'olympiade 84,71 % · avec un harnais ajusté Epoch evaluations
Écriture créative (évaluation de Lech Mazur) 83,8 % lechmazur/writing Github repository
GPQA Diamond — questions de niveau doctorat 80,39 % · avec un harnais ajusté Epoch evaluations
SWE-bench Verified — correction de bugs dans des dépôts 57,56 % · avec un harnais ajusté Epoch evaluations
SimpleQA Verified — exactitude factuelle 56 % Epoch evaluations
WeirdML — tâches d'apprentissage automatique inhabituelles 54,03 % budget de réflexion : 16K WeirdML Leaderboard
DeepResearch Bench — recherche approfondie 49,71 % DeepResearchBench Leaderboard
ARC-AGI — généralisation à des motifs inédits 41 % budget de réflexion : 16K · avec un harnais ajusté ARC Prize Leaderboard
Terminal-Bench — travail en ligne de commande 32,6 % · avec un harnais ajusté Terminal-Bench v2 Leaderboard
FrontierMath, niveaux 1–3 24,56 % Epoch evaluations
GDPval — tâches de métiers réels 23,3 %
Problèmes d'échecs 15,83 % Epoch evaluations
APEX-Agents 6,6 %
ARC-AGI-2 4,86 % budget de réflexion : 32K
CritPt — problèmes de physique 2 %
FrontierMath, niveau 4 — problèmes de recherche 0 % Epoch evaluations