Anthropic

Claude Sonnet 4.5

Type
modèle de langue
Contexte
1 000K tokens
Sortie maximale
64K
Sortie le
29 septembre 2025
Connaissances jusqu'à
juillet 2025
Chaîne pour l'API
claude-sonnet-4-5-20250929

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
qihang-ai $0,43 $2,14 31 juil. 2026
Jiekou.AI $2,7 $13,5 31 juil. 2026
NanoGPT $2,992 $14,994 31 juil. 2026
302.AI $3 $15 31 juil. 2026
Abacus.AI $3 $15 31 juil. 2026
Amazon Bedrock anthropic.claude-sonnet-4-5-20250929-v1:0 $3 $15 2 août 2026
Anthropic $3 $15 31 juil. 2026
Helicone $3 $15 31 juil. 2026
LLM Gateway $3 $15 31 juil. 2026
Merge Gateway $3 $15 31 juil. 2026
Amazon Bedrock eu.anthropic.claude-sonnet-4-5-20250929-v1:0 $3,3 $16,5 2 août 2026
Amazon Bedrock bedrock/us-gov-east-1/anthropic.claude-sonnet-4-5-20250929-v1:0 $3,6 $18 2 août 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

Un même fournisseur apparaît plusieurs fois s'il vend ce modèle sous des identifiants différents et à des prix différents — par exemple à des précisions de poids différentes. L'identifiant est indiqué à côté du nom. Les offres identiques arrivées de deux sources sous des orthographes différentes sont fusionnées en une seule ligne.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, programmation 1 485,37 1 480–1 490
Arena Score, requêtes longues 1 476,02 1 471–1 481
Arena Score, questions d'expert 1 472,22 1 464–1 481
Arena Score, dialogue à plusieurs tours 1 464,84 1 459–1 471
Arena Score, requêtes difficiles 1 461,7 1 458–1 465
Arena Score, respect des consignes 1 458,64 1 454–1 463
Arena Score en français 1 457,25 1 441–1 473
Arena Score en espagnol 1 455,76 1 442–1 470
Arena Score en anglais 1 451,19 1 447–1 455
Arena Score, écriture créative 1 440,99 1 435–1 447
Arena Score, classement général 1 437,78 1 435–1 441
Arena Score en russe 1 435,09 1 428–1 442
Arena Score, mathématiques 1 421,66 1 413–1 430
Arena Score, développement web 1 385,13 1 378–1 392
MATH, niveau de difficulté cinq 97,73 % budget de réflexion : 32K · avec un harnais ajusté Epoch evaluations
Mock AIME 2024–2025 — problèmes d'olympiade 77,76 % budget de réflexion : 59K · avec un harnais ajusté Epoch evaluations
GPQA Diamond — questions de niveau doctorat 76,43 % budget de réflexion : 16K · avec un harnais ajusté Epoch evaluations
SWE-bench Verified — correction de bugs dans des dépôts 71,28 % · avec un harnais ajusté Epoch evaluations
ARC-AGI — généralisation à des motifs inédits 63,67 % budget de réflexion : 32K · avec un harnais ajusté
OSWorld — travail dans un système d'exploitation, première version 62,9 % · avec un harnais ajusté OS World Website
Cybench — tâches de cybersécurité 60 % · avec un harnais ajusté Opus 4.5 System Card auto-déclaré
DeepResearch Bench — recherche approfondie 52,6 % budget de réflexion : 2K DeepResearchBench Leaderboard
WeirdML — tâches d'apprentissage automatique inhabituelles 47,71 % budget de réflexion : 16K WeirdML Leaderboard
Terminal-Bench — travail en ligne de commande 46,5 % · avec un harnais ajusté Terminal-Bench v2 Leaderboard
SimpleBench — questions pièges 45,16 % budget de réflexion : 12K SimpleBench Leaderboard
GDPval — tâches de métiers réels 42,5 %
FrontierMath, niveaux 1–3 23,86 % budget de réflexion : 32K Epoch evaluations
SimpleQA Verified — exactitude factuelle 23,6 % budget de réflexion : 59K Epoch evaluations
GSO-Bench — optimisation de code 14,71 % GSO Leaderboard
ARC-AGI-2 13,61 % budget de réflexion : 32K
Humanity’s Last Exam — questions d'expert 9,37 %
Problèmes d'échecs 7,41 % budget de réflexion : 32K Epoch evaluations
FrontierMath, niveau 4 — problèmes de recherche 2,44 % budget de réflexion : 32K Epoch evaluations
Remote Labor Index — missions issues d'une plateforme de freelance 2,08 %
CritPt — problèmes de physique 1,14 %