Anthropic

Claude 3 Opus 2024-02-29

Type
modèle de langue
Contexte
200K tokens
Sortie maximale
4K
Chaîne pour l'API
claude-3-opus-20240229

Le fournisseur a déclaré ce modèle obsolète. Il répond encore, mais mieux vaut ne pas démarrer de nouveaux projets dessus.

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Amazon Bedrock $15 $75 2 août 2026
Anthropic $15 $75 1 août 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score en russe 1 279,06 1 272–1 286
Arena Score, dialogue à plusieurs tours 1 275,39 1 269–1 281
Arena Score en français 1 273,88 1 255–1 293
Arena Score, mathématiques 1 272,58 1 266–1 279
Arena Score, programmation 1 264,67 1 259–1 271
Arena Score en anglais 1 262,98 1 259–1 267
Arena Score, classement général 1 262,17 1 259–1 265
Arena Score, requêtes longues 1 259,32 1 253–1 266
Arena Score, respect des consignes 1 248,74 1 244–1 253
Arena Score, requêtes difficiles 1 245,74 1 241–1 251
Arena Score en espagnol 1 245,51 1 227–1 264
Arena Score, écriture créative 1 235,21 1 229–1 242
Arena Score, questions d'expert 1 222,21 1 213–1 232
Arena Score, travail sur images 1 023,06 1 013–1 033
MATH, niveau de difficulté cinq 37,48 % · avec un harnais ajusté Epoch evaluations
GPQA Diamond — questions de niveau doctorat 29,55 % · avec un harnais ajusté Epoch evaluations
WeirdML — tâches d'apprentissage automatique inhabituelles 23,18 % WeirdML Leaderboard
Cybench — tâches de cybersécurité 10 % · avec un harnais ajusté Cybench leaderboard
SimpleBench — questions pièges 8,2 % SimpleBench Leaderboard
Mock AIME 2024–2025 — problèmes d'olympiade 4,63 % · avec un harnais ajusté Epoch evaluations
Problèmes d'échecs 0,04 % Epoch evaluations