claude-opus-4-1-20250805| Fournisseur | Entrée, $ par 1M | Sortie, $ par 1M | Dans nos données depuis |
|---|---|---|---|
| Jiekou.AI | $13,5 | $67,5 | 31 juil. 2026 |
| NanoGPT | $14,994 | $75,004 | 31 juil. 2026 |
| 302.AI | $15 | $75 | 31 juil. 2026 |
| Abacus.AI | $15 | $75 | 31 juil. 2026 |
| Amazon Bedrock | $15 | $75 | 2 août 2026 |
| Anthropic | $15 | $75 | 31 juil. 2026 |
| Helicone | $15 | $75 | 31 juil. 2026 |
| LLM Gateway | $15 | $75 | 31 juil. 2026 |
| Merge Gateway | $15 | $75 | 31 juil. 2026 |
Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.
La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.
| Jeu de tâches | Résultat | Conditions d'exécution | Mesuré par |
|---|---|---|---|
| Arena Score, programmation | 1 473,09 1 468–1 478 | — | — |
| Arena Score, requêtes longues | 1 445,19 1 440–1 450 | — | — |
| Arena Score en espagnol | 1 444,59 1 430–1 459 | — | — |
| Arena Score, dialogue à plusieurs tours | 1 441,82 1 436–1 448 | — | — |
| Arena Score, requêtes difficiles | 1 441,49 1 438–1 445 | — | — |
| Arena Score, respect des consignes | 1 433,82 1 429–1 439 | — | — |
| Arena Score en anglais | 1 428,72 1 425–1 433 | — | — |
| Arena Score en français | 1 427,47 1 410–1 445 | — | — |
| Arena Score, questions d'expert | 1 425,18 1 415–1 435 | — | — |
| Arena Score en russe | 1 422,37 1 414–1 430 | — | — |
| Arena Score, mathématiques | 1 421,84 1 413–1 430 | — | — |
| Arena Score, classement général | 1 417,42 1 414–1 420 | — | — |
| Arena Score, écriture créative | 1 410,22 1 404–1 416 | — | — |
| Arena Score, développement web | 1 388,74 1 378–1 400 | — | — |
| Écriture créative (évaluation de Lech Mazur) | 84,7 % | — | lechmazur/writing Github repository |
| SWE-bench Verified — correction de bugs dans des dépôts | 73,35 % | · avec un harnais ajusté | Epoch evaluations |
| GPQA Diamond — questions de niveau doctorat | 69,7 % | budget de réflexion : 27K · avec un harnais ajusté | Epoch evaluations |
| Mock AIME 2024–2025 — problèmes d'olympiade | 68,86 % | budget de réflexion : 27K · avec un harnais ajusté | Epoch evaluations |
| SimpleBench — questions pièges | 52 % | — | SimpleBench Leaderboard |
| DeepResearch Bench — recherche approfondie | 49,7 % | — | DeepResearchBench Leaderboard |
| GDPval — tâches de métiers réels | 43,6 % | — | — |
| WeirdML — tâches d'apprentissage automatique inhabituelles | 42,76 % | budget de réflexion : 16K | WeirdML Leaderboard |
| Cybench — tâches de cybersécurité | 42 % | · avec un harnais ajusté | Cybench leaderboard |
| Terminal-Bench — travail en ligne de commande | 38 % | · avec un harnais ajusté | Terminal-Bench v2 Leaderboard |
| SimpleQA Verified — exactitude factuelle | 34,8 % | budget de réflexion : 27K | Epoch evaluations |
| FrontierMath, niveaux 1–3 | 12,63 % | budget de réflexion : 32K | Epoch evaluations |
| Humanity’s Last Exam — questions d'expert | 7,06 % | — | — |
| FrontierMath, niveau 4 — problèmes de recherche | 2,44 % | budget de réflexion : 32K | Epoch evaluations |
| Problèmes d'échecs | 2,15 % | — | Epoch evaluations |