Alibaba (Qwen)

Qwen3.6 Max Preview

Type
modèle de langue
Contexte
262K tokens
Sortie maximale
66K
Sortie le
20 avril 2026
Chaîne pour l'API
qwen3.6-max-preview

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
OpenRouter $1,027 $6,162 31 juil. 2026
Kilo Code $1,04 $6,24 31 juil. 2026
Pioneer $1,04 $6,24 31 juil. 2026
AIHubMix $1,27 $7,61 31 juil. 2026
Alibaba (Qwen) $1,3 $7,8 31 juil. 2026
LLM Gateway $1,3 $7,8 31 juil. 2026
NanoGPT $1,3 $7,8 31 juil. 2026
EmpirioLabs AI $1,31 $7,88 31 juil. 2026
Merge Gateway $1,31 $7,88 31 juil. 2026
alibaba-cn $1,32 $7,9 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, développement web 1 478,18 1 465–1 491
Arena Score, questions d'expert 1 473,55 1 448–1 500
Arena Score, programmation 1 467,25 1 452–1 483
Arena Score, mathématiques 1 462,55 1 433–1 492
Arena Score, requêtes longues 1 457,94 1 444–1 472
Arena Score, dialogue à plusieurs tours 1 455,97 1 436–1 476
Arena Score, requêtes difficiles 1 455,91 1 445–1 466
Arena Score en français 1 455,35 1 413–1 498
Arena Score en espagnol 1 452,39 1 415–1 490
Arena Score en anglais 1 449,79 1 438–1 462
Arena Score, classement général 1 446,35 1 438–1 455
Arena Score en russe 1 444,75 1 419–1 471
Arena Score, respect des consignes 1 436,55 1 422–1 451
Arena Score, écriture créative 1 433,85 1 411–1 457
Mock AIME 2024–2025 — problèmes d'olympiade 91,1 % · avec un harnais ajusté Epoch evaluations
GPQA Diamond — questions de niveau doctorat 85,44 % · avec un harnais ajusté Epoch evaluations
SWE-bench Verified — correction de bugs dans des dépôts 76,65 % · avec un harnais ajusté Epoch evaluations
SimpleQA Verified — exactitude factuelle 56,93 % Epoch evaluations
SimpleBench — questions pièges 55,6 % SimpleBench Leaderboard
Problèmes d'échecs 12,67 % Epoch evaluations