OpenAI

GPT-4o (2024-11-20)

Type
modèle de langue
Contexte
128K tokens
Sortie maximale
16K
Sortie le
20 novembre 2024
Chaîne pour l'API
openai/gpt-4o-2024-11-20

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Abacus.AI $2,5 $10 31 juil. 2026
Kilo Code $2,5 $10 31 juil. 2026
Merge Gateway $2,5 $10 31 juil. 2026
Microsoft Foundry azure/global-standard/gpt-4o-2024-11-20 $2,5 $10 31 juil. 2026
NanoGPT $2,5 $10 31 juil. 2026
OpenAI $2,5 $10 31 juil. 2026
OpenRouter $2,5 $10 31 juil. 2026
OrcaRouter $2,5 $10 31 juil. 2026
Microsoft Foundry azure/eu/gpt-4o-2024-11-20 $2,75 $11 31 juil. 2026
Venice AI $3,125 $12,5 1 août 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

Un même fournisseur apparaît plusieurs fois s'il vend ce modèle sous des identifiants différents et à des prix différents — par exemple à des précisions de poids différentes. L'identifiant est indiqué à côté du nom. Les offres identiques arrivées de deux sources sous des orthographes différentes sont fusionnées en une seule ligne.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Écriture créative (évaluation de Lech Mazur) 81,8 % lechmazur/writing Github repository
GeoBench — localisation d'un lieu à partir d'une photo 71 % GeoBench leaderboard
MATH, niveau de difficulté cinq 49,77 % · avec un harnais ajusté Epoch evaluations
SWE-bench Verified — correction de bugs dans des dépôts 30,99 % · avec un harnais ajusté Epoch evaluations
GPQA Diamond — questions de niveau doctorat 30,51 % · avec un harnais ajusté Epoch evaluations
WeirdML — tâches d'apprentissage automatique inhabituelles 25,12 % WeirdML Leaderboard
Aider Polyglot — modifications de code dans six langages 18,2 % · avec un harnais ajusté Aider LLM Leaderboards
Cybench — tâches de cybersécurité 12,5 % · avec un harnais ajusté Cybench leaderboard
GDPval — tâches de métiers réels 9,9 %
The Agent Company — tâches de travail en environnement de bureau 8,6 % TheAgentCompany experiment results github
Mock AIME 2024–2025 — problèmes d'olympiade 6,16 % · avec un harnais ajusté Epoch evaluations
ARC-AGI — généralisation à des motifs inédits 4,5 % · avec un harnais ajusté ARC Prize Leaderboard
APEX-Agents 1,1 %
GSO-Bench — optimisation de code 0 % GSO Leaderboard
Humanity’s Last Exam — questions d'expert 0 %
CritPt — problèmes de physique 0 %
ARC-AGI-2 0 %