Clasamente modele AI

Clasamente AI multi-sursă pentru chat, vorbire, TTS, ASR, cod, imagine, video și agenți — de la arena.ai, OpenRouter și Artificial Analysis.

RangModelFurnizorCotă % ?Tokens ?Input ?OutputCache ?
1OpenAIgpt-5.6-luna-20260709OpenAI11.9%1.7T0.2001.200.020
2DeepSeekdeepseek-v4-flash-20260731DeepSeek11.3%1.6T0.0300.1000.0070
3Xiaomimimo-v2.5-20260422Xiaomi11.1%1.6T0.1400.2800.0028
4Zhipuglm-5.3-flash-20260826Zhipu10.9%1.6T0.0750.2500.015
5Tencenthy3-20260706Tencent6.8%963.0B0.1320.5280.033
6Nvidianemotron-3-ultra-550b-a55b-20260604Nvidia5.3%750.2B0.5002.200.100
7DeepSeekdeepseek-v4-flash-20260423DeepSeek5%711.5B0.0300.1000.0070
8MiniMaxminimax-m3-20260531MiniMax4.2%605.1B0.3001.200.060
9Tencenthy4-preview-20260827Tencent2.6%363.8B0.8342.500.042
10Googlegemini-3.7-flash-20260813Google2.5%353.6B0.7503.750.075
11Zhipuglm-5.2-20260616Zhipu2.4%338.1B1.193.740.221
12OpenAIgpt-5.6-sol-20260709OpenAI1.7%248.2B2.0010.00.200
13DeepSeekdeepseek-v4-pro-20260423DeepSeek1.6%233.3B0.6601.980.022
14Moonshotkimi-k3-20260715Moonshot1.6%226.0B3.0015.00.300
15Anthropicclaude-opus-5-20260723Anthropic1.5%220.7B5.0025.00.500

Sursă: OpenRouter · Actualizat 2026-08-28 · PandaNpc Actualizat 29 aug. 2026, 06:00 UTCVezi clasamentul complet →

Cum se citesc numerele

arena.ai (fost LMArena) le arată utilizatorilor două răspunsuri anonime la același prompt și îi roagă să aleagă unul, apoi derivă un rating Elo din aceste bătălii. Măsoară care răspuns este preferat de oameni — nu capacitatea obiectivă. Un stil plăcut poate câștiga, în timp ce un răspuns riguros dar verbose poate pierde.

Voturile sunt bătăliile acumulate de un model. Un model nou listat are puține voturi și un interval de încredere larg, astfel încât clasamentul său fluctuează ușor — citiți întotdeauna clasamentul împreună cu intervalul ±.

Tabloul Agent funcționează diferit față de celelalte: măsoară sesiuni reale de agent, nu preferințe oarbe prin vot. Indicatorul său principal, Net Improvement, este un procentaj de câștig — nu un rating Elo — deci nu poate fi comparat între tablouri. arena.ai raportează și cinci dimensiuni suplimentare (Confirmed Success, Steerability, Bash Recovery și altele) pe clasamentul complet.

Panoul de utilizare provine de la OpenRouter și numără cota reală de token API — dezvoltatorii votând cu portofelele lor, ceea ce completează panourile de preferințe subiective.

Clasamentele de vorbire provin de la Artificial Analysis: TTS folosește Speech Arena Elo cu ascultare în orb; ASR folosește AA-WER v2, unde o valoare mai mică este mai bună; iar Speech-to-Speech nativ folosește un compozit cu ponderi egale din Big Bench Audio, Full Duplex Bench și τ-Voice, unde o valoare mai mare este mai bună. Comparați scorurile doar în cadrul aceluiași clasament. Sursă: artificialanalysis.ai.

Clasamentul Intelligence Index provine de la Artificial Analysis: distilează multe repere publice într-un singur Intelligence Index de la 0 la 100, măsurând capacitatea obiectivă, nu preferința subiectivă — un complement natural pentru votul orb uman de pe arena.ai. Sursa: artificialanalysis.ai.