AI-modelltopplistor

Flerkälliga AI-rankningar för chatt, tal, TTS, ASR, kod, bild, video och agenter — från arena.ai, OpenRouter och Artificial Analysis.

RankModellLeverantörAndel % ?Tokens ?Input ?OutputCache ?
1OpenAIgpt-5.6-luna-20260709OpenAI11.9%1.7T0.2001.200.020
2DeepSeekdeepseek-v4-flash-20260731DeepSeek11.3%1.6T0.0300.1000.0070
3Xiaomimimo-v2.5-20260422Xiaomi11.1%1.6T0.1400.2800.0028
4Zhipuglm-5.3-flash-20260826Zhipu10.9%1.6T0.0750.2500.015
5Tencenthy3-20260706Tencent6.8%963.0B0.1320.5280.033
6Nvidianemotron-3-ultra-550b-a55b-20260604Nvidia5.3%750.2B0.5002.200.100
7DeepSeekdeepseek-v4-flash-20260423DeepSeek5%711.5B0.0300.1000.0070
8MiniMaxminimax-m3-20260531MiniMax4.2%605.1B0.3001.200.060
9Tencenthy4-preview-20260827Tencent2.6%363.8B0.8342.500.042
10Googlegemini-3.7-flash-20260813Google2.5%353.6B0.7503.750.075
11Zhipuglm-5.2-20260616Zhipu2.4%338.1B1.193.740.221
12OpenAIgpt-5.6-sol-20260709OpenAI1.7%248.2B2.0010.00.200
13DeepSeekdeepseek-v4-pro-20260423DeepSeek1.6%233.3B0.6601.980.022
14Moonshotkimi-k3-20260715Moonshot1.6%226.0B3.0015.00.300
15Anthropicclaude-opus-5-20260723Anthropic1.5%220.7B5.0025.00.500

Källa: OpenRouter · Uppdaterad 2026-08-28 · PandaNpc Uppdaterad 29 aug. 2026 06:00 UTCVisa hela topplistan →

Läsa dessa siffror

arena.ai (tidigare LMArena) visar användarna två anonyma svar på samma prompt och ber dem välja ett, och härleder sedan ett Elo-betyg från dessa matcher. Det mäter vilket svar folk föredrar — inte objektiv förmåga. En tilltalande stil kan vinna, medan ett noggrant men omständligt svar kan förlora.

Röster är de strider en modell har samlat på sig. En nyligen listad modell har få röster och ett brett konfidensintervall, så dess rankning svänger lätt — läs alltid rankningen tillsammans med ±-intervallet.

Agent-tavlan fungerar annorlunda än de andra: den mäter verkliga agentsessioner istället för blindröstpreferens. Dess huvudmått, Net Improvement, är en procentuell ökning — inte ett Elo-betyg — så det kan inte jämföras över tavlor. arena.ai rapporterar även ytterligare fem dimensioner (Confirmed Success, Steerability, Bash Recovery och andra) på den fullständiga ledartavlan.

Användningstavlan kommer från OpenRouter och räknar verklig API-tokenandel — utvecklare som röstar med sina plånböcker, vilket kompletterar de subjektiva preferenstavlorna.

Taltavlorna kommer från Artificial Analysis: TTS använder blindlyssnad Speech Arena Elo; ASR använder AA-WER v2, där lägre är bättre; och inbyggd Speech-to-Speech använder en likaviktad sammansättning av Big Bench Audio, Full Duplex Bench och τ-Voice, där högre är bättre. Jämför poäng endast inom samma tavla. Källa: artificialanalysis.ai.

Intelligence Index-tavlan kommer från Artificial Analysis: den destillerar många offentliga riktmärken till ett enda Intelligence Index från 0 till 100, som mäter objektiv förmåga snarare än subjektiv preferens — ett naturligt komplement till arena.ais mänskliga blindomröstning. Källa: artificialanalysis.ai.