OpenAI

GPT 4.1 2025-04-14

Type
modèle de langue
Contexte
1 048K tokens
Sortie maximale
33K
Chaîne pour l'API
azure/gpt-4.1-2025-04-14

Le fournisseur a déclaré ce modèle obsolète. Il répond encore, mais mieux vaut ne pas démarrer de nouveaux projets dessus.

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Microsoft Foundry azure/gpt-4.1-2025-04-14 $2 $8 31 juil. 2026
OpenAI $2 $8 31 juil. 2026
Microsoft Foundry azure/us/gpt-4.1-2025-04-14 $2,2 $8,8 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

Un même fournisseur apparaît plusieurs fois s'il vend ce modèle sous des identifiants différents et à des prix différents — par exemple à des précisions de poids différentes. L'identifiant est indiqué à côté du nom. Les offres identiques arrivées de deux sources sous des orthographes différentes sont fusionnées en une seule ligne.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, dialogue à plusieurs tours 1 396,99 1 390–1 404
Arena Score en anglais 1 390,3 1 386–1 395
Arena Score, programmation 1 390,24 1 384–1 397
Arena Score, requêtes longues 1 382,97 1 377–1 389
Arena Score, requêtes difficiles 1 382,46 1 378–1 387
Arena Score, classement général 1 382,06 1 378–1 386
Arena Score en français 1 381,97 1 359–1 405
Arena Score en russe 1 373,25 1 363–1 384
Arena Score en espagnol 1 368,54 1 349–1 388
Arena Score, mathématiques 1 367,35 1 357–1 378
Arena Score, respect des consignes 1 366,42 1 361–1 372
Arena Score, écriture créative 1 363,66 1 356–1 371
Arena Score, questions d'expert 1 363,58 1 352–1 375
Arena Score, reconnaissance de texte sur image 1 217,28 1 209–1 226
Arena Score, compréhension de schémas 1 214,97 1 202–1 228
Arena Score, travail sur images 1 209,86 1 203–1 217
MATH, niveau de difficulté cinq 83,01 % · avec un harnais ajusté Epoch evaluations
GeoBench — localisation d'un lieu à partir d'une photo 72 % GeoBench leaderboard
Fiction.LiveBench — maintien d'un contexte long 63,9 % Fiction.live leaderboard
GPQA Diamond — questions de niveau doctorat 55,89 % · avec un harnais ajusté Epoch evaluations
Aider Polyglot — modifications de code dans six langages 52,4 % · avec un harnais ajusté Aider LLM Leaderboards
SWE-bench Verified — correction de bugs dans des dépôts 48,54 % · avec un harnais ajusté Epoch evaluations
CadEval — construction de modèles CAO par le code 42 % CadEval Dashboard
WeirdML — tâches d'apprentissage automatique inhabituelles 39,04 % WeirdML Leaderboard
Mock AIME 2024–2025 — problèmes d'olympiade 38,27 % · avec un harnais ajusté Epoch evaluations
DeepResearch Bench — recherche approfondie 29,31 %
SimpleBench — questions pièges 12,4 % SimpleBench Leaderboard
ARC-AGI — généralisation à des motifs inédits 5,5 % · avec un harnais ajusté ARC Prize Leaderboard
Humanity’s Last Exam — questions d'expert 0,63 %
ARC-AGI-2 0,42 %