La même comparaison à l'aveugle que pour les images, mais pour la vidéo. Les modèles y sont dix fois moins nombreux que dans les sélections de texte, et les premières places se détachent plus nettement du reste — simplement parce qu'il y a peu de participants.
| # | Modèle | Développeur | Arena Score, vidéo | Connexion$ / 1M | Sortie$ / 1M | Contextetokens |
|---|---|---|---|---|---|---|
| 1 | Sora 2 Pro | OpenAI | 1 365,62 1 358–1 374 | — | — | — |
| 2 | Sora 2 | OpenAI | 1 337,11 1 330–1 344 | — | — | — |
| 3 | Seedance v1.5 Pro | ByteDance (Doubao) | 1 256,99 1 250–1 264 | — | — | — |
| 4 | Veo 3 ≈ | Google DeepMind | 1 252,4 1 241–1 263 | — | — | 0K |
| 5 | Veo 3 Fast ≈ | Google DeepMind | 1 247,67 1 236–1 259 | — | — | 0K |
| 6 | Veo 2 | Google DeepMind | 1 162,57 1 146–1 179 | — | — | 0K |
| 7 | Ray2 | Luma AI | 1 063,9 1 047–1 081 | — | — | 5K |
Le tableau défile latéralement : toutes les colonnes ne tiennent pas.
Le prix est le plus bas parmi les fournisseurs du modèle, tarif de base, hors tarifs par lots ou réduits. L'entrée et la sortie sont affichées séparément à dessein : chez la plupart des modèles, la sortie coûte plusieurs fois plus cher que l'entrée, et la facture finale dépend de ce qui domine dans la tâche.
Le signe ≈ marque les modèles dont l'intervalle de confiance recoupe celui de la ligne du dessus. Il y en a ici 2 modèles — leur ordre entre eux n'est pas déterminé par les données disponibles.
L'intervalle de confiance de la moitié des modèles est de 22,1 points, et c'est plus étroit que l'écart avec la ligne voisine : l'ordre ici est fixé par les données, pas par ceux qui ont voté cette fois-ci. Votes par modèle ici — médiane 15 230: moins il y en a, plus l'intervalle est large.
Arena (LMArena)
— licence CC-BY-4.0 · source primaire
По данным Arena (LMArena)