لوحات متصدرين نماذج الذكاء الاصطناعي
تصنيفات الذكاء الاصطناعي متعددة المصادر للدردشة والكلام وTTS وASR والبرمجة والصور والفيديو والوكلاء — من arena.ai وOpenRouter وArtificial Analysis.
| الترتيب | النموذج | المزود | Elo ? | الأصوات ? |
|---|---|---|---|---|
| 1 | minimax-h3 | MiniMax | 1489 ±7 | 13,020 |
| 2 | dreamina-seedance-2.5-720p | Bytedance | 1484 ±12 | 2,912 |
| 3 | dreamina-seedance-2.0-720p | Bytedance | 1478 ±8 | 105,298 |
| 4 | gemini-omni-flash | 1462 ±6 | 54,179 | |
| 5 | grok-imagine-video-1.5-720p | SpaceXAI | 1460 ±5 | 99,649 |
| 6 | flux-3-video-20260811 | Black Forest Labs | 1449 ±10 | 3,770 |
| 7 | happyhorse-1.0 | Alibaba-ATH | 1442 ±10 | 70,772 |
| 8 | wan2.7-i2v | Alibaba | 1427 ±5 | 57,878 |
| 9 | grok-imagine-video-720p | SpaceXAI | 1415 ±5 | 517,108 |
| 10 | veo-3.1-audio | 1397 ±11 | 25,156 | |
| 11 | veo-3.1-audio-1080p | 1390 ±9 | 53,179 | |
| 12 | veo-3.1-fast-audio | 1384 ±9 | 99,932 | |
| 13 | grok-imagine-video-480p | SpaceXAI | 1384 ±8 | 19,443 |
| 14 | veo-3.1-fast-audio-1080p | 1371 ±10 | 54,455 | |
| 15 | vidu-q3-pro | Shengshu | 1362 ±9 | 36,723 |
المصدر: arena.ai · تم التحديث Aug 14, 2026 · PandaNpc تم التحديث 29 أغسطس 2026، 06:00 UTCعرض لوحة المتصدرين كاملة →
قراءة الأرقام
arena.ai (المعروفة سابقًا باسم LMArena) تعرض للمستخدمين إجابتين مجهولتين لنفس الطلب وتطلب منهم اختيار واحدة، ثم تستخلص تصنيف Elo من تلك المعارك. إنها تقيس أي إجابة يفضلها الناس — وليس القدرة الموضوعية. يمكن للأسلوب المحبوب أن يفوز، بينما قد تخسر إجابة دقيقة ولكن مطولة.
الأصوات هي المعارك التي جمعها النموذج. النموذج المُدرَج حديثًا لديه عدد قليل من الأصوات وفاصل ثقة واسع، لذلك يتقلب ترتيبه بسهولة — اقرأ دائمًا الترتيب مع فاصل ±.
يعمل لوحة Agent بشكل مختلف عن البقية: فهي تقيس جلسات الوكيل الحقيقية بدلاً من تفضيل التصويت الأعمى. مقياسها الرئيسي، Net Improvement، هو نسبة مئوية — وليس تصنيف Elo — لذلك لا يمكن مقارنته عبر اللوحات. كما تقدم arena.ai خمسة أبعاد إضافية (Confirmed Success، Steerability، Bash Recovery وغيرها) على لوحة المتصدرين الكاملة.
لوحة الاستخدام تأتي من OpenRouter وتحتسب حصة API token الحقيقية — المطورون يصوتون بمحافظهم، وهو ما يكمل لوحات التفضيل الذاتية.
لوحات الكلام مصدرها Artificial Analysis: TTS يستخدم Elo الخاص بـ Speech Arena عبر استماع أعمى؛ ASR يستخدم AA-WER v2، حيث القيمة الأقل أفضل؛ وSpeech-to-Speech الأصلي يستخدم مزيجًا متساوي الأوزان من Big Bench Audio وFull Duplex Bench وτ-Voice، حيث القيمة الأعلى أفضل. قارن النتائج فقط ضمن اللوحة نفسها. المصدر: artificialanalysis.ai.
لوحة Intelligence Index مصدرها Artificial Analysis: تقوم بتقطير العديد من المعايير العامة إلى مؤشر ذكاء واحد من 0 إلى 100، يقيس القدرة الموضوعية بدلاً من التفضيل الذاتي — وهو مكمل طبيعي للتصويت البشري الأعمى في arena.ai. المصدر: artificialanalysis.ai.
