Alibaba (Qwen)

Qwen3 Max 2025-09-23

Type
modèle de langue
Contexte
258K tokens
Sortie maximale
66K
Sortie le
24 septembre 2025
Chaîne pour l'API
qwen3-max-2025-09-23

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
302.AI $0,86 $3,43 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, programmation 1 439,19 1 426–1 452
Arena Score, mathématiques 1 438,73 1 415–1 462
Arena Score, dialogue à plusieurs tours 1 436,77 1 422–1 451
Arena Score, requêtes difficiles 1 424,87 1 416–1 433
Arena Score en anglais 1 420,37 1 412–1 429
Arena Score en russe 1 419,24 1 396–1 443
Arena Score, classement général 1 413,19 1 407–1 420
Arena Score, requêtes longues 1 412,27 1 400–1 425
Arena Score, respect des consignes 1 399,35 1 388–1 411
Arena Score, questions d'expert 1 397,86 1 371–1 425
Arena Score en espagnol 1 397,75 1 368–1 428
Arena Score, écriture créative 1 382,56 1 366–1 400
MATH, niveau de difficulté cinq 97,13 % · avec un harnais ajusté Epoch evaluations
Mock AIME 2024–2025 — problèmes d'olympiade 73,31 % · avec un harnais ajusté Epoch evaluations
SimpleQA Verified — exactitude factuelle 67,47 % Epoch evaluations
Fiction.LiveBench — maintien d'un contexte long 66,7 % Fiction.live leaderboard
GPQA Diamond — questions de niveau doctorat 63,47 % · avec un harnais ajusté Epoch evaluations
Problèmes d'échecs 0 % Epoch evaluations