AI Model Liderlik Tabloları

Sohbet, konuşma, TTS, ASR, kod, görüntü, video ve ajanlar için çok kaynaklı AI sıralamaları — arena.ai, OpenRouter ve Artificial Analysis'tan.

SıraModelSatıcıPay % ?Tokens ?Input ?OutputCache ?
1OpenAIgpt-5.6-luna-20260709OpenAI11.9%1.7T0.2001.200.020
2DeepSeekdeepseek-v4-flash-20260731DeepSeek11.3%1.6T0.0300.1000.0070
3Xiaomimimo-v2.5-20260422Xiaomi11.1%1.6T0.1400.2800.0028
4Zhipuglm-5.3-flash-20260826Zhipu10.9%1.6T0.0750.2500.015
5Tencenthy3-20260706Tencent6.8%963.0B0.1320.5280.033
6Nvidianemotron-3-ultra-550b-a55b-20260604Nvidia5.3%750.2B0.5002.200.100
7DeepSeekdeepseek-v4-flash-20260423DeepSeek5%711.5B0.0300.1000.0070
8MiniMaxminimax-m3-20260531MiniMax4.2%605.1B0.3001.200.060
9Tencenthy4-preview-20260827Tencent2.6%363.8B0.8342.500.042
10Googlegemini-3.7-flash-20260813Google2.5%353.6B0.7503.750.075
11Zhipuglm-5.2-20260616Zhipu2.4%338.1B1.193.740.221
12OpenAIgpt-5.6-sol-20260709OpenAI1.7%248.2B2.0010.00.200
13DeepSeekdeepseek-v4-pro-20260423DeepSeek1.6%233.3B0.6601.980.022
14Moonshotkimi-k3-20260715Moonshot1.6%226.0B3.0015.00.300
15Anthropicclaude-opus-5-20260723Anthropic1.5%220.7B5.0025.00.500

Kaynak: OpenRouter · Güncellendi 2026-08-28 · PandaNpc Güncellendi 29 Ağu 2026 06:00 UTCTam liderlik tablosunu görüntüle →

Bu sayılar nasıl okunur?

arena.ai (eski adıyla LMArena) kullanıcılara aynı istem için iki anonim yanıt gösterir ve birini seçmelerini ister, ardından bu savaşlardan bir Elo derecesi türetir. Hangi yanıtın insanlar tarafından tercih edildiğini ölçer — nesnel yeteneği değil. Sevimli bir tarz kazanabilirken, titiz ama ayrıntılı bir yanıt kaybedebilir.

Oylar, bir modelin biriktirdiği savaşlardır. Yeni listelenen bir modelin az oyu ve geniş bir güven aralığı vardır, bu nedenle sıralaması kolayca değişir — sıralamayı her zaman ± aralığıyla birlikte okuyun.

Ajan panosu diğerlerinden farklı çalışır: kör oylama tercihi yerine gerçek ajan oturumlarını ölçer. Başlık metriği Net Improvement, bir yüzdelik kazançtır — bir Elo derecesi değil — bu nedenle panolar arasında karşılaştırılamaz. arena.ai ayrıca tam liderlik tablosunda beş boyut daha raporlar (Confirmed Success, Steerability, Bash Recovery ve diğerleri).

Kullanım panosu OpenRouter'dan gelir ve gerçek API token payını sayar — geliştiricilerin cüzdanlarıyla oy kullanması, bu da subjektif tercih panolarını tamamlar.

Konuşma panoları Artificial Analysis'ten gelir: TTS, kör dinlemeli Speech Arena Elo kullanır; ASR, AA-WER v2 kullanır (daha düşük daha iyidir); ve yerel Speech-to-Speech, Big Bench Audio, Full Duplex Bench ve τ-Voice'in eşit ağırlıklı bir bileşimini kullanır (daha yüksek daha iyidir). Puanları yalnızca aynı pano içinde karşılaştırın. Kaynak: artificialanalysis.ai.

Intelligence Index panosu Artificial Analysis'tan gelir: birçok kamu kıyaslamasını tek bir 0-100 Intelligence Index'te özetler, öznel tercih yerine nesnel yeteneği ölçer — arena.ai'nin insan kör oylamasına doğal bir tamamlayıcıdır. Kaynak: artificialanalysis.ai.