llama-3.1-405b-instruct| Fournisseur | Entrée, $ par 1M | Sortie, $ par 1M | Dans nos données depuis |
|---|---|---|---|
| Hyperbolic | $0,12 | $0,3 | 1 août 2026 |
| Nebius Token Factory | $1 | $3 | 1 août 2026 |
| Google Vertex AI | $5 | $16 | 31 juil. 2026 |
| SambaNova | $5 | $10 | 1 août 2026 |
| Databricks | $5 | $15 | 1 août 2026 |
| Amazon Bedrock | $5,32 | $16 | 2 août 2026 |
| Microsoft Foundry | $5,33 | $16 | 1 août 2026 |
| OCI Generative AI | $10,68 | $10,68 | 31 juil. 2026 |
Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.
La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.
| Jeu de tâches | Résultat | Conditions d'exécution | Mesuré par |
|---|---|---|---|
| Arena Score en anglais | 1 308,06 1 303–1 313 | — | — |
| Arena Score, dialogue à plusieurs tours | 1 287,34 1 280–1 295 | — | — |
| Arena Score, programmation | 1 284 1 277–1 291 | — | — |
| Arena Score, classement général | 1 281,97 1 278–1 286 | — | — |
| Arena Score, mathématiques | 1 278,23 1 270–1 286 | — | — |
| Arena Score en français | 1 269,69 1 242–1 297 | — | — |
| Arena Score, requêtes difficiles | 1 263,75 1 258–1 270 | — | — |
| Arena Score, écriture créative | 1 260,14 1 253–1 268 | — | — |
| Arena Score, requêtes longues | 1 259,79 1 252–1 267 | — | — |
| Arena Score, respect des consignes | 1 259,06 1 254–1 264 | — | — |
| Arena Score en russe | 1 255,23 1 247–1 264 | — | — |
| Arena Score en espagnol | 1 252,29 1 227–1 277 | — | — |
| Arena Score, questions d'expert | 1 228,55 1 216–1 241 | — | — |
| MATH, niveau de difficulté cinq | 49,77 % | · avec un harnais ajusté | Epoch evaluations |
| GPQA Diamond — questions de niveau doctorat | 34,55 % | · avec un harnais ajusté | Epoch evaluations |
| WeirdML — tâches d'apprentissage automatique inhabituelles | 21,38 % | — | WeirdML Leaderboard |
| Mock AIME 2024–2025 — problèmes d'olympiade | 9,63 % | · avec un harnais ajusté | Epoch evaluations |
| SimpleBench — questions pièges | 7,6 % | — | SimpleBench Leaderboard |
| Cybench — tâches de cybersécurité | 7,5 % | · avec un harnais ajusté | Cybench leaderboard |
| The Agent Company — tâches de travail en environnement de bureau | 7,4 % | — | TheAgentCompany experiment results github |