التحليل الشامل لـ Claude Fable 5.1: المعايير والتحسينات والسعر والسرعة
النتائج الكاملة لـ Claude Fable 5.1 على 7 فئات من المعايير الرئيسية، مقارنةً بندًا بندًا مع Fable 5 وOpus 5 وGPT-5.6 Sol، مع شرح المهام الطويلة واستدعاء الأدوات وتكاليف التخزين المؤقت والسرعة وقيود الباقات وتغييرات الترحيل في 5.1.

تم الإصدار الرسمي لـ Claude Fable 5.1 في 1 سبتمبر 2026. لنبدأ بالخلاصة: هذا ليس ترقية نموذجية عادية للمحادثة العامة، بل هو نموذج رائد عالي التكلفة مُعدّ لـالبرمجة طويلة الأمد، والأبحاث المعقدة، واستدعاء الأدوات عبر التطبيقات، ووكلاء Agent غير المراقَبين. وفي سبع فئات رئيسية من المعايير التي نشرتها Anthropic، يتفوق Fable 5.1 على Fable 5 في جميعها؛ لكن سعر واجهة API لكل وحدة ما يزال ضعف سعر Opus 5، كما تصنّف الجهة الرسمية زمن الاستجابة النسبي بأنه «أبطأ».
إذا كانت مهمتك تقتصر على تعديل ملف واحد، أو كتابة نص قصير، أو الإجابة عن أسئلة عادية، فلا تزال Anthropic توصي بالبدء من Opus 5. أما Fable 5.1 فهو أكثر ملاءمةً للمهام الطويلة متعددة الخطوات التي لا تستطيع النماذج العادية إنجازها بثبات حتى مع effort مرتفع. تجمع هذه المقالة بين بيانات الإصدار الرسمية، ودلالات كل معيار، والتحسينات المحددة في 5.1، والسعر، والسرعة، وقيود الترحيل، لتجنّب النظر إلى صورة نتائج «من فاز» فقط.
جدول واحد لفهم مواصفات Fable 5.1
| البند | Claude Fable 5.1 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| نافذة السياق | 1M token | 1M token | 1M token |
| أقصى إخراج | 128K token | 128K token | 128K token |
| سعر الإدخال | $10 / MTok | $5 / MTok | $2 / MTok |
| سعر الإخراج | $50 / MTok | $25 / MTok | $10 / MTok |
| زمن الاستجابة النسبي | أبطأ | متوسط | سريع |
| Thinking | Adaptive، مفعّل دائمًا | Adaptive | Adaptive |
| مستوى الـ effort الافتراضي | High | High | High |
| حدّ المعرفة الموثوق | يونيو 2026 | مايو 2026 | يناير 2026 |
«الأبطأ» هنا مأخوذ من كتالوج نماذج Anthropic، وهو يعبّر عن مستوى زمن الاستجابة النسبي، وليس عدد tokens ثابتًا في الثانية. تعتمد المدة الفعلية لإنجاز مهمة ما أيضًا على effort، وعدد جولات استدعاء الأدوات، ومعدل الإصابة في التخزين المؤقت (cache)، وطول السياق، وعدد مرات إعادة المحاولة بعد الفشل.
الجدول الكامل لمعايير Fable 5.1 الرئيسية
يعتمد الجدول التالي مباشرةً على الجدول الرئيسي في صفحة إصدار Anthropic بتاريخ 1 سبتمبر 2026. ولتجنّب القراءة الخاطئة، تُفصَل النسب المئوية، والدرجة الخام لـ GDPval-AA، ونتيجتا OSWorld الجزئية/الصارمة، ونتيجتا HLE مع الأدوات/بدون الأدوات كلٌّ على حدة. يحتفظ كل معيار باسمه الإنجليزي الرسمي، مع إعطاء ترجمته في السطر التالي؛ وتعرض الإصدارات اللغوية الأخرى الاسم المترجم إلى لغتها تحت الاسم الإنجليزي.
| القدرة | المعيار | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol | 5.1 مقارنةً بـ Fable 5 |
|---|---|---|---|---|---|---|
| أبحاث علمية للوكلاء | Terminal-Bench-Science 0.1 معيار الطرفية للبحث العلمي بوكلاء Agent |
52.6% | 24.7% | 29.0% | 22.4% | +27.9 نقطة مئوية |
| برمجة الطرفية للوكلاء | Terminal-Bench 4.0 معيار البرمجة الطرفية للوكلاء |
55.8% | 42.0% | 52.3% | 37.3% | +13.8 نقطة مئوية |
| الأعمال المعرفية المتخصصة | GDPval-AA v2 معيار المهام الاحترافية ذات القيمة الاقتصادية الحقيقية |
1853 | 1723 | 1824 | 1711 | +130 نقطة |
| تشغيل الحاسوب | OSWorld 2.0 — Partial معيار تشغيل الحاسوب الفعلي: درجة الإنجاز الجزئي |
77.9% | 72.9% | 75.4% | — | +5.0 نقاط مئوية |
| تشغيل الحاسوب | OSWorld 2.0 — Strict معيار تشغيل الحاسوب الفعلي: معدل الإكمال الصارم |
41.7% | 36.1% | 39.6% | — | +5.6 نقاط مئوية |
| الاستدلال متعدد التخصصات | Humanity's Last Exam — No tools اختبار البشرية الأخير: بدون استخدام الأدوات |
60.9% | 57.8% | 56.6% | — | +3.1 نقطة مئوية |
| الاستدلال متعدد التخصصات | Humanity's Last Exam — With tools اختبار البشرية الأخير: مع استخدام الأدوات |
65.0% | 63.8% | 63.6% | — | +1.2 نقطة مئوية |
| سير العمل التجاري | AutomationBench معيار أتمتة سير العمل التجاري عبر التطبيقات |
31.4% | 17.1% | 26.9% | 19.6% | +14.3 نقطة مئوية |
| البرمجة بالوكلاء | CursorBench 3.2.0 معيار مهام البرمجة متعددة الملفات الواقعية |
73.4% | 70.5% | 70.0% | 67.2% | +2.9 نقطة مئوية |
— تعني أن الجدول الرئيسي الصادر عن Anthropic لم يقدّم نتيجة مقابلة، ولا تعني أن النموذج غير قادر على إنجاز المهمة. في Terminal-Bench 4.0، حقق Mythos 5.1 — الأقل قيودًا والمتاح فقط للبرامج الموثوقة — نتيجة 60.9%؛ تركز هذه المقالة على Fable 5.1 المتاح للمستخدمين العاديين، ولا تخلط نتائج Mythos في عمود Fable.
ماذا يقيس Terminal-Bench-Science 0.1؟
يتضمن Terminal-Bench-Science 0.1 70 سير عمل بحثيًا حقيقيًا في خمسة مجالات كبرى: علوم الحياة، والعلوم الفيزيائية، وعلوم الأرض، والرياضيات، والهندسة. المهام ليست أسئلة اختيار من متعدد، بل تطلب من Agent إنجاز تحليل البيانات، والاستدلال الإحصائي، والمحاكاة، والتحسين، وإثبات المبرهنات، وإعادة بناء الصور، أو التعلم الآلي العلمي داخل الطرفية، والتحقق من المخرجات عبر اختبارات قابلة لإعادة الإنتاج.
نسبة Fable 5.1 البالغة 52.6% مقابل 24.7% لـ Fable 5 في تجارب إعادة الإنتاج الرسمية تمثّل قفزة بمقدار 27.9 نقطة مئوية، وهي أكبر قفزة واضحة في الجدول بأكمله. لكن الجهة الرسمية تشير في الوقت نفسه إلى خطأ معياري يبلغ نحو ±3.5–4.5 نقطة مئوية لكل نموذج، لذلك لا ينبغي التعامل مع الرقم بعد الفاصلة العشرية كترتيب مطلق الدقة.
ماذا يقيس Terminal-Bench 4.0 وCursorBench 3.2.0؟
يُخضع Terminal-Bench Agent لمهام معقدة في بيئة طرفية حقيقية، مع التركيز على ما إذا كان قادرًا على فهم البيئة، واستدعاء الأدوات، وتعديل الملفات، واجتياز التحقق في النهاية. حصل Fable 5.1 على 55.8%، أي أعلى من Fable 5 بـ 13.8 نقطة مئوية، ويتجاوز أيضًا نسبة Opus 5 البالغة 52.3%.
أما CursorBench 3.2 فيأتي من مهام غامضة متعددة الملفات في جلسات Cursor حقيقية، وقد أضافت نسخة 3.2 مسائل في اتّباع التعليمات واستخدام الأدوات المتقدمة. حقق Fable 5.1 Max نسبة 73.4%، وتفوّقه ليس مبالغًا فيه كما في Terminal-Bench-Science، لكنه يستخدم في المتوسط 72,060 token بتكلفة $9.64 لكل مهمة؛ بينما يستخدم Fable 5 Max 103,525 token بتكلفة $17.32. ما يستحق الاهتمام هنا هو انخفاض الـ token والتكلفة عند إنجاز المهام نفسها، وليس النقاط المئوية 2.9 بحد ذاتها.
ماذا يقيس GDPval-AA v2؟
يستخدم GDPval-AA v2 220 مهمة صمّمها متخصصون في المجال، تغطي 44 مهنة و9 قطاعات صناعية، لتقييم قدرة النموذج على معالجة الأعمال المعرفية الحقيقية ذات القيمة الاقتصادية. نتيجته 1853 هي درجة مركّبة وليست 1853%. تشير هذه النتيجة إلى أن Fable 5.1 يتفوق على Fable 5 في المستندات والتحليلات والمخرجات الاحترافية، ويتفوق أيضًا بشكل طفيف على Opus 5.
لماذا يوجد رقمان لـ OSWorld 2.0؟
يحتوي OSWorld 2.0 على 108 سير عمل طويلة لتشغيل الحاسوب، ويبلغ الوسيط الزمني لإنجاز الإنسان لكل مهمة نحو 1.6 ساعة. يمنح Partial درجة إنجاز جزئية استنادًا إلى نقاط تفتيش متعددة؛ بينما لا يعتبر Strict المهمة ناجحة إلا عند بلوغ الهدف كاملًا.
لذلك لا يوجد تناقض بين 77.9% في partial و41.7% في strict لـ Fable 5.1: فهو غالبًا ما يُكمل معظم الخطوات، لكن جزءًا من المهام ما يزال لا يُستكمَل من طرف إلى طرف. وهذا يذكّرنا أيضًا بأن «الانشغال المستمر بالعمل» لوكلاء الحاسوب لا يعني نجاح المهمة.
ماذا يقيس Humanity's Last Exam؟
أنشأ Humanity's Last Exam كلٌّ من Center for AI Safety وScale AI، ويضم 2,500 سؤال متعدد التخصصات بمستوى خبراء ويصعب الإجابة عنها بالاعتماد على بحث بسيط. يتفوق Fable 5.1 على Fable 5 بـ 3.1 نقاط مئوية في ظروف عدم استخدام الأدوات، وبـ 1.2 نقطة مئوية فقط عند السماح بالأدوات. إنه أقوى فعلًا، لكن ليس في كل المعايير تظهر قفزات مضاعفة.
ماذا يقيس AutomationBench؟
يفحص AutomationBench ما إذا كان Agent قادرًا على إنجاز سير عمل المبيعات والتسويق والعمليات وخدمة العملاء والمالية والموارد البشرية عبر أدوات SaaS محاكاة مثل CRM والبريد الإلكتروني والتقويم والرسائل وإدارة المشاريع. ارتفعت نتيجة Fable 5.1 من 17.1% إلى 31.4%، أي بتحسّن نسبي يبلغ نحو 84%، مما يشير إلى تقدّم جوهري في إدارة حالة التطبيقات المتعددة وتنفيذ الخطوات الطويلة؛ لكن 31.4% تؤكد أيضًا أن أتمتة الأعمال غير المراقَبة من هذا النوع ما تزال بعيدة عن الحل.
ما الذي تحسّن في Fable 5.1 مقارنةً بـ Fable 5؟
1. المهام طويلة الأمد أقل ميلًا إلى سلوك الطرق المختصرة
تضع Anthropic نموذج Fable 5.1 في موقع نموذج Agent للمهام الطويلة: يخطط أولًا، ثم يستخدم الأدوات، ويسترد عافيته بعد الفشل، ويتحقق من النتائج، ويبادر بالإبلاغ عن التقدم. وهو يشدد على إصلاح السبب الجذري بدلًا من الالتفاف الموضعي لمجرد جعل اختبار واحد يتحول إلى اللون الأخضر في أسرع وقت. تشمل السيناريوهات المستهدفة المذكورة رسميًا: الميزات عبر قواعد الأكواد، ومراجعة الكود، وتحسين الأداء، والجلسات الذاتية التي تستمر عدة أيام، والبحث، والمستندات، والجداول، والعروض التقديمية.
2. حتى مستوى الـ effort المنخفض يقترب من نتائج الجيل السابق عالية التكلفة
أضاف Fable 5.1 القدرة على ضبط الـ effort لكل رسالة. ويُظهر منحنى التكلفة الرسمي أن الـ effort المنخفض Low أو المتوسط Medium يمكنه في بعض المهام بلوغ نتائج Fable 5 أو تجاوزها، مع خفض الـ token والتكاليف. يستخدم Claude Code الـ High effort افتراضيًا؛ بينما يستخدم Claude.ai وCowork الـ Medium افتراضيًا، لذا يجب التحقق من مستوى الـ effort أولًا عند مقارنة النماذج، ولا يمكن وضع نتائج مستويات مختلفة جنبًا إلى جنب مباشرة.
3. عرض تقدّم قابل للقراءة بين استدعاءات الأدوات
أضافت API قدرة تجريبية display: "updates" تتيح للنموذج إعطاء تحديثات تقدّم موجّهة للمستخدم بين استدعاءات الأدوات. وفي المهام التي تستغرق ساعات، يسهل من خلالها فهم ما يفعله النموذج وما إذا كان ينحرف عن الهدف، مقارنةً بمجرد رؤية بطاقات أدوات تظهر تباعًا.
4. الكتابة والتحقق البصري والاختبار الذاتي أكثر اكتمالًا
تقول الجهة الرسمية إن 5.1 يبادر إلى كتابة اختبارات للتحقق من تعديلاته، ويستخدم قدراته البصرية لفحص المخرجات مقابل الأهداف التصميمية. كما تركّز تقييمات الشركاء على تقارير تقدّم أكثر إيجازًا، وإجابات أكثر اكتمالًا للأسئلة متعددة الأجزاء، وتتبّع سلاسل الاستدعاءات عبر خدمات متعددة، والحفاظ على قابلية القراءة بعد التشغيل الطويل. هذه ملاحظات نوعية، ولا ينبغي تقديمها كاستنتاجات معيارية موحدة.
5. الحجب الأمني أكثر دقة، لكنه لم يختفِ
انخفضت الإنذارات الكاذبة في دفاعات الأمن السيبراني لدى Fable 5.1 بنحو 60% مقارنةً بفترة إطلاق Fable 5، وانخفض معدل خفض التصنيف الناتج عن مسائل علم الأحياء والطب الأساسية بنحو 85%. يمكن استخدامه الآن لاكتشاف الثغرات البرمجية، لكن المهام ذات الاستخدام المزدوج مثل اختبار الاختراق، وتوليد أكواد الاستغلال، وفحص الثغرات الثنائية قد تظل تُوجَّه إلى Opus. ولا تُحصَّل رسوم بسعر Fable بعد توجيه الطلب.
6. إضافة علامات مصدر المحتوى
يُدخل Fable 5.1 مفهوم content provenance. قد يحمل النص المُولَّد علامة مائية إحصائية يمكن التحقق منها عبر أداة فحص المحتوى من Anthropic. وهي لا تضيف علامات مرئية إلى نص المقال، لكنها سلوك جديد ينبغي فهمه مسبقًا بالنسبة إلى منصات المحتوى والتعليم والتدقيق المؤسسي.
كيف تُحتسب تكاليف Fable 5.1؟
| بند الفوترة | سعر Fable 5.1 | مقارنةً بـ Fable 5 |
|---|---|---|
| الإدخال | $10 / مليون token | نفسه |
| الإخراج | $50 / مليون token | نفسه |
| الكتابة إلى التخزين المؤقت لمدة 5 دقائق | $12.50 / مليون token | نفس الفئة |
| الكتابة إلى التخزين المؤقت لمدة ساعة | $20 / مليون token | نفس الفئة |
| قراءة التخزين المؤقت | $0.25 / مليون token | انخفاض بنسبة 75% |
| Batch API | 50% من سعر الإدخال والإخراج | وفقًا لقواعد Batch |
لنفترض أن مهمة طويلة قرأت إجمالًا 10 ملايين token مخزَّن مؤقتًا، وولّدت 200 ألف token إدخال جديد و50 ألف token إخراج، دون احتساب الكتابة إلى التخزين المؤقت:
缓存读取:10 × $0.25 = $2.50
新输入:0.2 × $10 = $2.00
输出:0.05 × $50 = $2.50
合计:$7.00إن قراءة 10 ملايين token مخزَّن مؤقتًا نفسها تكلف نحو $10 على Fable 5، أي بفارق $7.50 في هذا البند وحده. وبناءً على ذلك تقدّر Anthropic أن التكلفة الفعلية للمهام النموذجية المفوترة بالـ token يمكن أن تنخفض بنحو 25%، وبحد أقصى نحو 45% في المهام شديدة الاعتماد على الوكلاء والتي تعيد استخدام سياقات طويلة بشكل متكرر. هذا ليس تخفيضًا شاملاً في أسعار API المعلنة، بل كلما زادت إصابات التخزين المؤقت، كان التوفير أوضح.
المشتركون لا يستفيدون بالضرورة مباشرةً من تخفيض سعر التخزين المؤقت في API
يمكن للمقعد المميز premium seat في Max وTeam/Enterprise استخدام ما يصل إلى 50% من الحصة الأسبوعية لنماذج Fable؛ بينما يستهلك Pro والمقاعد القياسية usage credits منذ البداية. ويُعتمد في تفاصيل الاستهلاك على صفحة Usage في الحساب. إن تخفيض سعر قراءة التخزين المؤقت هو تغيير يخص سيناريوهات الفوترة بالـ token بشكل رئيسي، ولا يصح تحويل تخفيض الـ cache بنسبة 75% في API إلى «استخدام Max أربعة أضعاف» مباشرة.
ما مدى سرعة Fable 5.1 فعلًا؟
الإجابة هي: استجابة الجولة الواحدة أبطأ نسبيًا، لكن إجمالي زمن إنجاز المهام المعقدة قد يكون أقصر.
- يصنف كتالوج نماذج Anthropic Fable 5.1 بـ
Slower، وOpus 5 بـModerate، وSonnet 5 بـFast. - يستخدم Claude Code الـ High effort افتراضيًا، مما يستهلك وقتًا أطول في الاستدلال بطبيعة الحال مقارنةً بـ Low أو Medium.
- تقول شركة Every إن Fable 5.1 على أعباء عملها الخاصة أسرع بنحو مرتين من Opus 5 ويستهلك نصف الـ token؛ هذا اختبار محدد من شريك وليس ضمانًا عامًا للسرعة.
- في CursorBench، يبلغ متوسط خطوات Fable 5.1 Max 70 خطوة و72,060 token؛ بينما يبلغ Fable 5 Max 72 خطوة نفسها لكنه استهلك 103,525 token. تبدو ميزة 5.1 أقرب إلى «تجنّب الالتفافات واستهلاك قدر أقل من الـ token»، ولا تظهر بالضرورة على أنها استجابة أسرع لصدور الحرف الأول.
لذلك، اختر Sonnet 5 أو Opus 5 أولًا للدردشة والكود القصير والتفاعل المتكرر؛ وفكّر في Fable 5.1 للمهام غير المراقَبة التي تتطلب تصحيحًا عبر قواعد أكواد متعددة، وأبحاثًا طويلة، وتحققًا ذاتيًا.
تغييرات التوافق التي يجب التعامل معها قبل الترقية إلى Fable 5.1
ترقية Claude Code إلى 2.1.250 على الأقل
يشترط شرح الخطط والتوفر الصادر عن Anthropic استخدام Claude Code 2.1.250 أو أحدث. إذا لم يظهر لك Fable 5.1، تحقق أولًا:
claude --versionثم حدّث بالطريقة الرسمية لترقية Claude Code، وأعد تشغيل الجلسة. معرّف نموذج API الخاص بـ Fable 5.1 هو:
claude-fable-5-1Forced tool use قد يُرجع خطأً مباشرة
إذا كان الطلب يُجبر النموذج على استدعاء أداة معينة، فقد يُرجع Fable 5.1 خطأ. قبل الترحيل، ينبغي فحص tool_choice وسير عمل فرض الأدوات في Agent المخصص، وعدم افتراض أن سلوك Fable 5 متوافق تمامًا.
لا يمكن إعادة استخدام Thinking blocks بين النماذج كيفما اتُفق
لا يمكن للنماذج الأقدم قراءة thinking blocks الخاصة بـ Fable 5.1. عند تبديل النموذج، ينبغي ترك SDK يتعامل مع هذه الكتل وفق القواعد الرسمية، بدلًا من تمريرها كما هي إلى نموذج آخر.
تعديل السجل القديم قد يؤدي إلى خطأ 400
بالنسبة إلى حسابات API الجديدة التي أُنشئت بعد 31 أغسطس 2026، تظل thinking blocks صالحة فقط ضمن بادئة المحادثة الأصلية التي وُلّدت فيها. وقد يؤدي تعديل system أو tools أو الرسائل الأقدم ثم إعادة تمرير thinking blocks إلى إرجاع خطأ 400. توصي الجهة الرسمية بإبقاء السجل بنمط الإضافة فقط append-only؛ وعند الحاجة إلى الضغط، استبدِل السجل القديم بالكامل بملخص جديد واحد، ولا تعدّل الجولات القديمة مع الإبقاء على thinking blocks الأصلية. لمزيد من التفاصيل، راجع دليل مطالبات Fable 5.1 والترحيل.
متى يجب اختيار Fable 5.1؟
مناسب لـ:
- المهام الطويلة عبر مستودعات أو خدمات أو تطبيقات متعددة؛
- وكلاء Agent يحتاجون إلى العمل لساعات واسترداد الفشل بأنفسهم؛
- البحث العلمي، وتحليل البيانات المعقدة، والمخرجات الاحترافية متعددة المراحل؛
- المشاكل النظامية صعبة الاستنساخ، وتحسين الأداء، وتتبّع السبب الجذري؛
- أعباء عمل API التي تتطلب إعادة استخدام كثيفة للسياقات الطويلة، وتمثل قراءة التخزين المؤقت فيها نسبة كبيرة.
غير مناسب لـ:
- الدردشة البسيطة، أو المقالات القصيرة، أو التعديلات الصغيرة على ملف واحد؛
- التفاعلات اللحظية الحساسة بشدة لزمن وصول الحرف الأول؛
- المهام عالية الإخراج ذات الميزانية الثابتة دون إعادة استخدام للتخزين المؤقت؛
- السيناريوهات التي لا يمكنها قبول الاحتفاظ الافتراضي ببيانات المراقبة الأمنية لمدة 30 يومًا، ولا تنطبق عليها شروط الاستثناء المؤسسي؛
- أعباء العمل التي تريد ألا يخضع أي طلب من طلبات الأمن السيبراني أو علوم الحياة فيها لخفض التصنيف.
كيف تتابع المهام الطويلة عن بُعد؟
تظهر قيمة Fable 5.1 غالبًا في المهام التي تستغرق ساعات أو حتى أيامًا، لكن ذلك لا يعني أن على المستخدم البقاء أمام جهاز التطوير طوال الوقت. تأكد أولًا من توفر Fable 5.1 في Claude Code 2.1.250+ على جهازك المحلي، ثم استخدم PandaNpc Agent لعرض جلسات Claude Code على جهاز التطوير نفسه من المتصفح أو سطح المكتب أو الهاتف، والتعامل مع التفاعلات ومواصلة إصدار الأوامر.
ما يتغير هنا هو نقطة الدخول للتحكم فقط؛ فالكود والأدوات والبناء ما تزال تعمل على جهاز التطوير لديك. يمكنك أولًا قراءة دليل الوصول عن بُعد إلى Claude Code ودرس توصيل Claude Code بالهاتف، وبعد التأكد من رابط التحكم عن بُعد، أسنِد المهام الطويلة إلى Fable 5.1.
الأسئلة الشائعة (FAQ)
كم يزيد Fable 5.1 قوةً عن Fable 5؟
يختلف الأمر اختلافًا كبيرًا بين المهام. ففي Terminal-Bench-Science ارتفع بمقدار 27.9 نقطة مئوية، وفي AutomationBench بـ 14.3 نقطة مئوية؛ بينما لم يتجاوز ارتفاعه في HLE مع الأدوات 1.2 نقطة مئوية. لا يمكن استخدام أكبر زيادة منفردة لتمثيل جميع المهام.
هل Fable 5.1 أسرع من Opus 5؟
في جدول زمن الاستجابة النسبي الرسمي، يكون Fable 5.1 «أبطأ» وOpus 5 «متوسطًا». وقد لاحظ بعض الشركاء أن Fable 5.1 أسرع في المهام الكاملة، لأنه يستهلك عددًا أقل من الـ token ويعيد العمل بشكل أقل. هذان الاستنتاجان لا يقيسان الأمر نفسه.
هل Fable 5.1 أكثر ملاءمةً للبرمجة من GPT-5.6 Sol؟
في جدول إصدار Anthropic، تكون نتائج Fable 5.1 أعلى في Terminal-Bench-Science وTerminal-Bench وAutomationBench وCursorBench؛ لكن النماذج المختلفة تستخدم هياكل Agent harness مختلفة، ومستويات effort وأدوات وأسعارًا مختلفة، لذا لا يمكن الجزم بأن Fable يتفوق على كل المستودعات الحقيقية. يمكنك الرجوع إلى درس إعداد سياق 1M لـ GPT-5.6 Sol، ثم إجراء اختبار A/B على مهامك التمثيلية.
لماذا يتحول Fable 5.1 فجأة إلى Opus؟
تُوجَّه بعض طلبات الأمن السيبراني وعلوم الحياة إلى Opus عبر آليات الحماية safeguards. إن تبديل النموذج ليس عطلًا بالضرورة؛ وتوضح Anthropic أن الطلبات التي تُوجَّه بهذه الطريقة لا تُفوتر بسعر Fable.
هل يترك Fable 5.1 علامة مائية؟
توجد آلية content provenance إحصائية، لكنها لا تضيف وسومًا مرئية على سطح النص. وهي ليست العلامة المائية المرئية نفسها التي توضع في زاوية الصور.
الخلاصة
تتركّز أبرز تحسينات Claude Fable 5.1 في البحث العلمي والمهام الطرفية وسير العمل التجاري عبر التطبيقات: فهو أكثر قدرة على التنفيذ المستمر، واسترداد الفشل، والتحقق من النتائج، كما خفّض تكلفة المهام الطويلة عبر قراءة تخزين مؤقت أرخص. لكنه ما يزال مرتفع السعر، وبطيء الاستجابة في الجولة الواحدة نسبيًا، ويجلب تغييرات توافقية تتعلق بـ thinking blocks وفرض استدعاء الأدوات وتعديل السجل.
ليس السؤال الصحيح لاختياره هو «هل يحتل المركز الأول في المعايير؟»، بل: هل مهمتك طويلة ومعقدة بما يكفي، وهل تكلفة الفشل وإعادة العمل مرتفعة إلى الحد الذي يجعل استخدام Fable 5.1 جديرًا بالاهتمام؟ إذا كان الجواب بالنفي، فعادةً ما يكون البدء من Opus 5 أو Sonnet 5 أكثر ملاءمةً.
أدلة ذات صلة

Codex لتفعيل سياق Sol 1M الخاص بـ GPT-5.6: دليل إعداد `config.toml` في 3 أسطر
يدعم GPT-5.6 Sol رسميًا سياقًا يبلغ 1.05 مليون توكن. فقط أضف 3 أسطر من الإعدادات أعلى ملف config.toml الخاص بـ Codex لتشغيله بنافذة مليون توكن، مع ضغط تلقائي للتاريخ عند حوالي 900 ألف توكن. مرفق إعداد دائم، وأمر لمرة واحدة، والتحقق، وتذكير بالتكلفة.
اقرأ المقال →
كيف تستخدم Claude Code Remote Control؟ التحكم عن بُعد من الهاتف، القيود الرسمية والبدائل (2026)
كيف يتم تفعيل التحكم عن بعد في Claude Code؟ تقدم هذه المقالة ثلاثة استخدامات رسمية: claude remote-control و claude --remote-control و /remote-control، وتشرح الاتصال بالهاتف والمتصفح، ومتطلبات الحساب، وطرق التحقق، والأخطاء الشائعة، وتقارن حلول PandaNpc في سيناريوهات النموذج المخصص وCodex والأجهزة المتعددة.
اقرأ المقال →
الاتصال بـ Claude Code من الهاتف: أداة لعرض الجلسات والموافقات على iOS في أي وقت
هذا المقال موجّه للمطوّرين، ويستعرض أفضل الممارسات لتوصيل Claude Code عبر الهاتف المحمول. من خلال تطبيق PandaNpc على iOS، يمكنك مشاهدة الجلسات لحظيًا، والموافقة على استدعاءات الأدوات، والرد على الأسئلة. وباستخدام pandapaw وiOS Live Activity، يمكن تحقيق تحكم عن بُعد عالي الكفاءة، مما يرفع مرونة البرمجة.
اقرأ المقال →