Alibaba (Qwen)

Qwen3 235B A22B Thinking-2507

Type
modèle de langue
Contexte
262K tokens
Sortie maximale
262K
Sortie le
25 juillet 2025
Connaissances jusqu'à
juin 2025
Chaîne pour l'API
Qwen/Qwen3-235B-A22B-Thinking-2507
Poids
ouverts

Le fournisseur a déclaré ce modèle obsolète. Il répond encore, mais mieux vaut ne pas démarrer de nouveaux projets dessus.

Prix par fournisseur

Fournisseur Entrée, $ par 1M Sortie, $ par 1M Dans nos données depuis
Weights & Biases $0,1 $0,1 31 juil. 2026
Kilo Code $0,11 $0,6 31 juil. 2026
OpenRouter openrouter/qwen/qwen3-235b-a22b-thinking-2507 $0,11 $0,6 31 juil. 2026
io.net $0,11 $0,6 31 juil. 2026
siliconflow-cn $0,13 $0,6 31 juil. 2026
SiliconFlow $0,13 $0,6 31 juil. 2026
submodel $0,2 $0,6 31 juil. 2026
Fireworks AI $0,22 $0,88 31 juil. 2026
OpenRouter qwen/qwen3-235b-a22b-thinking-2507 $0,23 $2,3 1 août 2026
novita-ai $0,3 $3 31 juil. 2026
DeepInfra $0,3 $2,9 31 juil. 2026
Hugging Face $0,3 $3 31 juil. 2026
Jiekou.AI $0,3 $3 31 juil. 2026
LLM Gateway $0,3 $3 31 juil. 2026
NanoGPT $0,3 $0,5 31 juil. 2026
Novita AI $0,3 $3 31 juil. 2026
Venice AI $0,45 $3,5 31 juil. 2026
Together AI $0,65 $3 31 juil. 2026

Seul le tarif de base et uniquement les prix au token sont affichés. Les tarifs par lots, réduits ou mis en cache, ainsi que les prix par image ou par seconde de vidéo, n'entrent pas dans ce tableau : ils ne peuvent pas figurer dans la même colonne qu'un prix par million de tokens.

Un même fournisseur apparaît plusieurs fois s'il vend ce modèle sous des identifiants différents et à des prix différents — par exemple à des précisions de poids différentes. L'identifiant est indiqué à côté du nom. Les offres identiques arrivées de deux sources sous des orthographes différentes sont fusionnées en une seule ligne.

La date de la dernière colonne est le jour où ce prix est entré pour la première fois dans notre collecte. Le prix peut être plus ancien : avant ce jour, nous ne l'enregistrions tout simplement pas. Il n'a pas changé depuis — sinon une nouvelle ligne avec une nouvelle date figurerait à sa place.

Résultats des mesures

Jeu de tâches Résultat Conditions d'exécution Mesuré par
Arena Score, questions d'expert 1 456,35 1 428–1 485
Arena Score en anglais 1 427,11 1 418–1 436
Arena Score, programmation 1 423,79 1 409–1 438
Arena Score, requêtes difficiles 1 415,65 1 406–1 425
Arena Score, classement général 1 413,74 1 407–1 420
Arena Score, mathématiques 1 412,99 1 389–1 437
Arena Score, dialogue à plusieurs tours 1 405,77 1 390–1 421
Arena Score en russe 1 398,06 1 372–1 425
Arena Score, requêtes longues 1 397,5 1 383–1 412
Arena Score en espagnol 1 390,57 1 345–1 436
Arena Score, écriture créative 1 386,32 1 368–1 404
Arena Score, respect des consignes 1 384,95 1 373–1 397
Mock AIME 2024–2025 — problèmes d'olympiade 86,65 % · avec un harnais ajusté Epoch evaluations
Écriture créative (évaluation de Lech Mazur) 82,4 % lechmazur/writing Github repository
Fiction.LiveBench — maintien d'un contexte long 75 % Fiction.live leaderboard
GPQA Diamond — questions de niveau doctorat 73,4 % · avec un harnais ajusté Epoch evaluations
SimpleQA Verified — exactitude factuelle 50,1 % Epoch evaluations
WeirdML — tâches d'apprentissage automatique inhabituelles 41,04 % WeirdML Leaderboard
Problèmes d'échecs 7,41 % Epoch evaluations
CritPt — problèmes de physique 0 %