OpenAI

GPT 5.4 2026-03-05

Type
modèle de langue
Contexte
1 050K tokens
Sortie maximale
128K
Chaîne pour l'API
azure_ai/gpt-5.4-2026-03-05

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Microsoft Foundry azure_ai/gpt-5.4-2026-03-05 $2,5 $15 31 juil. 2026
OpenAI $2,5 $15 31 juil. 2026
Microsoft Foundry azure/eu/gpt-5.4-2026-03-05 $2,75 $16,5 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

Un même fournisseur apparaît plusieurs fois s'il vend ce modèle sous des identifiants différents et à des prix différents — par exemple à des précisions de poids différentes. L'identifiant est indiqué à côté du nom. Les offres identiques arrivées de deux sources sous des orthographes différentes sont fusionnées en une seule ligne.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Mock AIME 2024–2025 — problèmes d'olympiade 97,78 % effort : medium · avec un harnais ajusté Epoch evaluations
ARC-AGI — généralisation à des motifs inédits 93,67 % effort : xhigh · avec un harnais ajusté
GPQA Diamond — questions de niveau doctorat 91,07 % effort : medium · avec un harnais ajusté Epoch evaluations
Terminal-Bench — travail en ligne de commande 81,8 % · avec un harnais ajusté https://www.tbench.ai/leaderboard/terminal-bench/2.0
FrontierMath, niveaux 1–3 78,6 % effort : xhigh Epoch evaluations
WeirdML — tâches d'apprentissage automatique inhabituelles 77,7 % effort : xhigh WeirdML Leaderboard
SWE-bench Verified — correction de bugs dans des dépôts 76,86 % effort : high · avec un harnais ajusté Epoch evaluations
ARC-AGI-2 73,95 % effort : xhigh
FrontierMath, niveau 4 — problèmes de recherche 49 % effort : xhigh Epoch evaluations
SimpleQA Verified — exactitude factuelle 44,84 % effort : xhigh Epoch evaluations
Problèmes d'échecs 41,08 % effort : medium Epoch evaluations
APEX-Agents 36 % effort : xhigh
DeepResearch Bench — recherche approfondie 35,09 % effort : low https://drb.futuresearch.ai/#drb auto-déclaré
Humanity’s Last Exam — questions d'expert 33,03 % effort : xhigh
GSO-Bench — optimisation de code 31,37 % effort : xhigh https://gso-bench.github.io/index.html
CritPt — problèmes de physique 23,43 % effort : xhigh