xAI

Grok 3 Mini

Type
modèle de langue
Contexte
131K tokens
Sortie maximale
8K
Sortie le
11 avril 2025
Chaîne pour l'API
xai/grok-3-mini

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Microsoft Foundry $0,25 $1,27 31 juil. 2026
vercel_ai_gateway $0,3 $0,5 31 juil. 2026
Helicone $0,3 $0,5 31 juil. 2026
OCI Generative AI $0,3 $0,5 31 juil. 2026
Poe $0,3 $0,5 31 juil. 2026
xAI $0,3 $0,5 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score en anglais 1 373,29 1 367–1 380
Arena Score, mathématiques 1 370,22 1 356–1 384
Arena Score, programmation 1 366,03 1 357–1 375
Arena Score, requêtes difficiles 1 363,32 1 357–1 370
Arena Score, classement général 1 362,74 1 358–1 368
Arena Score, questions d'expert 1 360,62 1 344–1 378
Arena Score, requêtes longues 1 356,9 1 348–1 366
Arena Score en espagnol 1 355,7 1 322–1 390 effort : high
Arena Score en français 1 352,74 1 308–1 398 effort : high
Arena Score en russe 1 350,69 1 335–1 366
Arena Score, dialogue à plusieurs tours 1 349,13 1 340–1 359
Arena Score, respect des consignes 1 345,63 1 338–1 354
Arena Score, écriture créative 1 330,28 1 317–1 343 effort : high
MATH, niveau de difficulté cinq 90,94 % effort : low · avec un harnais ajusté Epoch evaluations
Mock AIME 2024–2025 — problèmes d'olympiade 77,76 % effort : low · avec un harnais ajusté Epoch evaluations
Écriture créative (évaluation de Lech Mazur) 73,5 % effort : low lechmazur/writing Github repository
GPQA Diamond — questions de niveau doctorat 68,35 % effort : high · avec un harnais ajusté Epoch evaluations
Fiction.LiveBench — maintien d'un contexte long 66,7 % effort : medium Fiction.live leaderboard
Aider Polyglot — modifications de code dans six langages 49,3 % effort : low · avec un harnais ajusté Aider LLM Leaderboards
WeirdML — tâches d'apprentissage automatique inhabituelles 42,58 % effort : high WeirdML Leaderboard
SimpleQA Verified — exactitude factuelle 21,1 % effort : high Epoch evaluations
ARC-AGI — généralisation à des motifs inédits 16,5 % effort : low · avec un harnais ajusté ARC Prize Leaderboard
ARC-AGI-2 0,42 % effort : low