AI-mallien sijoituslistat
Monilähteiset AI-sijoitukset chatille, puheelle, TTS:lle, ASR:lle, koodille, kuvalle, videolle ja agenteille — arena.ai:sta, OpenRouterista ja Artificial Analysisista.
| Sija | Malli | Toimittaja | Elo ? | Äänet ? |
|---|---|---|---|---|
| 1 | gemini-omni-flash | 1512 ±11 | 16,916 | |
| 2 | flux-3-video | Black Forest Labs | 1494 ±17 | 1,291 |
| 3 | dreamina-seedance-2.0-720p | Bytedance | 1482 ±10 | 49,058 |
| 4 | dreamina-seedance-2.5-720p | Bytedance | 1477 ±19 | 1,337 |
| 5 | muse-video | Meta | 1457 ±15 | 2,176 |
| 6 | minimax-h3 | MiniMax | 1453 ±13 | 3,081 |
| 7 | happyhorse-1.0 | Alibaba-ATH | 1428 ±13 | 22,113 |
| 8 | sora-2-pro | OpenAI | 1364 ±7 | 46,509 |
| 9 | veo-3.1-audio | 1364 ±14 | 13,743 | |
| 10 | veo-3.1-audio-1080p | 1363 ±10 | 24,979 | |
| 11 | veo-3.1-fast-audio | 1361 ±10 | 39,441 | |
| 12 | veo-3.1-fast-audio-1080p | 1358 ±10 | 25,771 | |
| 13 | veo-3-fast-audio | 1347 ±11 | 25,219 | |
| 14 | grok-imagine-video-720p | SpaceXAI | 1345 ±7 | 154,827 |
| 15 | wan2.7-t2v | Alibaba | 1344 ±9 | 17,769 |
Lähde: arena.ai · Päivitetty Aug 14, 2026 · PandaNpc Päivitetty 29.8.2026 klo 06.00 UTCNäytä koko sijoituslista →
Numeroiden lukeminen
arena.ai (entinen LMArena) näyttää käyttäjille kaksi anonymisoitua vastausta samaan kehotteeseen ja pyytää heitä valitsemaan yhden, sitten se laskee Elo-arvosanan näiden taistelujen perusteella. Se mittaa, kumpaa vastausta ihmiset suosivat – ei objektiivista kyvykkyyttä. Miellyttävä tyyli voi voittaa, kun taas perusteellinen mutta pitkäveteinen vastaus voi hävitä.
Äänet ovat taisteluita, joita malli on kerännyt. Vasta listatulla mallilla on vähän ääniä ja leveä luottamusväli, joten sen sijoitus heilahtelee helposti — lue aina sijoitus yhdessä ±-välin kanssa.
Agentti-paneeli toimii eri tavalla kuin muut: se mittaa oikeita agenttisessioita eikä sokeita äänestysmieltymyksiä. Sen päätunnusluku, Net Improvement, on prosentuaalinen nousu — ei Elo-luokitus — joten sitä ei voi verrata paneelien välillä. arena.ai raportoi myös viisi muuta ulottuvuutta (Confirmed Success, Steerability, Bash Recovery ja muita) koko johtotaululla.
Käyttötaulu tulee OpenRouterista ja laskee todellista API-token-osuutta — kehittäjien äänestäessä lompakoillaan, mikä täydentää subjektiivisia mieltymystauluja.
Puhelistat ovat peräisin Artificial Analysis -palvelusta: TTS käyttää sokkokuunteluun perustuvaa Speech Arena Elo -pisteistöä; ASR käyttää AA-WER v2:ta, jossa pienempi arvo on parempi; ja natiivi Speech-to-Speech käyttää Big Bench Audio-, Full Duplex Bench- ja τ-Voice-arvioinneista koostuvaa yhtä painotettua yhdistelmää, jossa suurempi arvo on parempi. Vertaa pisteitä vain saman listan sisällä. Lähde: artificialanalysis.ai.
Intelligence Index -listaus on peräisin Artificial Analysisilta: se tiivistää monet julkiset vertailuarvot yhdeksi 0–100 Intelligence Indexiksi, mitaten objektiivista kyvykkyyttä subjektiivisen mieltymyksen sijaan — luonnollinen täydennys arena.ai:n ihmisten sokealle äänestykselle. Lähde: artificialanalysis.ai.
