OpenAI

GPT 4.5 Preview

Type
modèle de langue
Contexte
128K tokens
Sortie maximale
16K
Chaîne pour l'API
azure/gpt-4.5-preview

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Microsoft Foundry $75 $150 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, dialogue à plusieurs tours 1 443,92 1 430–1 457
Arena Score en anglais 1 419,49 1 412–1 427
Arena Score en russe 1 418,24 1 403–1 434
Arena Score en français 1 418,01 1 362–1 474
Arena Score, classement général 1 417,47 1 412–1 423
Arena Score, mathématiques 1 411,89 1 397–1 427
Arena Score, requêtes longues 1 406 1 392–1 420
Arena Score, respect des consignes 1 404,35 1 396–1 413
Arena Score, requêtes difficiles 1 403,65 1 394–1 414
Arena Score, programmation 1 397,05 1 384–1 410
Arena Score, écriture créative 1 394,29 1 382–1 406
Arena Score, questions d'expert 1 393,91 1 371–1 417
Arena Score, travail sur images 1 195,13 1 183–1 207
MATH, niveau de difficulté cinq 78,63 % · avec un harnais ajusté Epoch evaluations
Écriture créative (évaluation de Lech Mazur) 75,6 % lechmazur/writing Github repository
Fiction.LiveBench — maintien d'un contexte long 63,9 % Fiction.live leaderboard
GPQA Diamond — questions de niveau doctorat 58,25 % · avec un harnais ajusté Epoch evaluations
Aider Polyglot — modifications de code dans six langages 44,9 % · avec un harnais ajusté Aider LLM Leaderboards
WeirdML — tâches d'apprentissage automatique inhabituelles 39,37 % WeirdML Leaderboard
Mock AIME 2024–2025 — problèmes d'olympiade 37,72 % · avec un harnais ajusté Epoch evaluations
SimpleBench — questions pièges 21,4 % SimpleBench Leaderboard
Cybench — tâches de cybersécurité 17,5 % · avec un harnais ajusté Cybench leaderboard
ARC-AGI — généralisation à des motifs inédits 10,3 % · avec un harnais ajusté ARC Prize Leaderboard
ARC-AGI-2 0,8 %
Humanity’s Last Exam — questions d'expert 0,67 %