GPT-6 Sol vs Claude Opus 5.5: الأسعار ونتائج التقييم وكيف تختار لمهام البرمجة؟

لمهام برمجة API العامة، جرّب أولًا GPT-6 Sol؛ وللمهام المعقدة، يمكن مقارنة Claude Opus 5.5، ثم اجعل GPT-6 Astra وClaude Fable 5.1 خيارين للمهام عالية الصعوبة. تتحقق هذه المقالة من المواصفات الرسمية للنماذج الأربعة، وأسعار التخزين المؤقت وBatch، ونتائج اختبارات طرف ثالث بمنهجية موحدة، وتقدّم خمسة سيناريوهات تكلفة قابلة لإعادة الحساب.

PandaNpcنُشر لأول مرة في
GPT-6 Sol vs Claude Opus 5.5: الأسعار ونتائج التقييم وكيف تختار لمهام البرمجة؟

الخلاصة أولاً: يمكن لمهام البرمجة العامة عبر API أن تبدأ بتجربة GPT-6 Sol. سعر الإدخال/الإخراج القياسي لديه هو $2/$10 لكل مليون token، وكلاهما نصف سعر Claude Opus 5.5؛ وفي أعلى إعداد ضمن نظام التقييم نفسه لدى Artificial Analysis (AA)، بلغ المؤشر الشامل لـ Opus 5.5 قيمة 58، بينما بلغ Sol قيمة 48. ولا تكون العلاقة بينهما «أقوى بالسعر نفسه»: قارن أولاً باستخدام مهام مستودعك الخاصة معدل النجاح من المحاولة الأولى، وعدد الجولات، وإجمالي token، وإعادة العمل اليدوية، ثم قرر ما إذا كنت ستدفع مقابل النتائج الأعلى لـ Opus. يمكن للمهام الطويلة الأصعب أن تتجه إلى GPT-6 Astra أو Claude Fable 5.1، لكن أسعار الوحدة وقدرات النماذج الأربعة لا تترتب بالترتيب نفسه.

نحن ندير PandaNpc الذي يدعم Codex وClaude Code، لذا لدينا سياق استخدام للمنتج؛ لم يُجرِ هذا المقال اختبارًا فعليًا للنماذج الأربعة على المهمة نفسها، ولا يدّعي أن التقييمات العامة الواردة أدناه هي اختبارات أجراها موقعنا. تشير الأسعار إلى رسوم API للنماذج، لا إلى أسعار اشتراكات الأدوات. تم التحقق من المعلومات في 23 سبتمبر 2026، وجميع العملات بالدولار الأمريكي.

مواصفات النماذج الأربعة: ميّز أولاً بين السعة والإخراج والإعداد الافتراضي

لتسهيل القراءة على الهاتف، يقسّم الجدول التالي النماذج حسب OpenAI وAnthropic؛ «أقصى إخراج» هو الحد الأعلى لاستجابة واحدة، أما السياق فهو النافذة المتاحة لمجموع الإدخال والإخراج، ولا يعني أن كل مرة يمكن أن يُنتج الطول نفسه. يمكن استخدام API model ID مباشرة للتحقق من الفاتورة أو إعداد التقييم.

مواصفات OpenAI GPT-6 Sol GPT-6 Astra
API model ID gpt-6-sol gpt-6-astra
التموضع الرسمي توازن بين التكلفة والقدرة أكثر المهام تعقيدًا من البداية إلى النهاية
نافذة السياق 1,050,000 token 1,050,000 token
أقصى إخراج لمرة واحدة 128,000 token 128,000 token
وسائط الإدخال/الإخراج نص، صورة → نص نص، صورة → نص
جهد الاستدلال none / low / medium / high / xhigh / max low / medium / high / xhigh / max
effort الافتراضي medium غير مذكور في صفحة النموذج الرسمية
تاريخ قطع المعرفة 2026-04-20 2026-04-30
حالة الإتاحة متاح عبر API متاح عبر API
API model ID
GPT-6 Sol
gpt-6-sol
GPT-6 Astra
gpt-6-astra
التموضع الرسمي
GPT-6 Sol
توازن بين التكلفة والقدرة
GPT-6 Astra
أكثر المهام تعقيدًا من البداية إلى النهاية
نافذة السياق
GPT-6 Sol
1,050,000 token
GPT-6 Astra
1,050,000 token
أقصى إخراج لمرة واحدة
GPT-6 Sol
128,000 token
GPT-6 Astra
128,000 token
وسائط الإدخال/الإخراج
GPT-6 Sol
نص، صورة → نص
GPT-6 Astra
نص، صورة → نص
جهد الاستدلال
GPT-6 Sol
none / low / medium / high / xhigh / max
GPT-6 Astra
low / medium / high / xhigh / max
effort الافتراضي
GPT-6 Sol
medium
GPT-6 Astra
غير مذكور في صفحة النموذج الرسمية
تاريخ قطع المعرفة
GPT-6 Sol
2026-04-20
GPT-6 Astra
2026-04-30
حالة الإتاحة
GPT-6 Sol
متاح عبر API
GPT-6 Astra
متاح عبر API

البيانات: صفحة نموذج GPT-6 Sol الرسمية، صفحة نموذج GPT-6 Astra الرسمية.

مواصفات Anthropic Claude Opus 5.5 Claude Fable 5.1
API model ID claude-opus-5-5 claude-fable-5-1
التموضع الرسمي برمجة agent طويلة المدى والعمل المعرفي استدلال أكثر صعوبة وعمل agent طويل المدى
نافذة السياق 1,000,000 token 1,000,000 token
أقصى إخراج لمرة واحدة 128,000 token؛ يمكن أن يصل Batch beta إلى 300,000 128,000 token
وسائط الإدخال/الإخراج نص، صورة → نص نص، صورة → نص
طريقة الاستدلال adaptive thinking، مفعّل دائمًا adaptive thinking، مفعّل دائمًا
effort الافتراضي medium high
تاريخ قطع المعرفة 2026-06 2026-06
حالة الإتاحة متاح عبر Claude API متاح عبر Claude API
API model ID
Claude Opus 5.5
claude-opus-5-5
Claude Fable 5.1
claude-fable-5-1
التموضع الرسمي
Claude Opus 5.5
برمجة agent طويلة المدى والعمل المعرفي
Claude Fable 5.1
استدلال أكثر صعوبة وعمل agent طويل المدى
نافذة السياق
Claude Opus 5.5
1,000,000 token
Claude Fable 5.1
1,000,000 token
أقصى إخراج لمرة واحدة
Claude Opus 5.5
128,000 token؛ يمكن أن يصل Batch beta إلى 300,000
Claude Fable 5.1
128,000 token
وسائط الإدخال/الإخراج
Claude Opus 5.5
نص، صورة → نص
Claude Fable 5.1
نص، صورة → نص
طريقة الاستدلال
Claude Opus 5.5
adaptive thinking، مفعّل دائمًا
Claude Fable 5.1
adaptive thinking، مفعّل دائمًا
effort الافتراضي
Claude Opus 5.5
medium
Claude Fable 5.1
high
تاريخ قطع المعرفة
Claude Opus 5.5
2026-06
Claude Fable 5.1
2026-06
حالة الإتاحة
Claude Opus 5.5
متاح عبر Claude API
Claude Fable 5.1
متاح عبر Claude API

البيانات: صفحة نموذج Opus 5.5 الرسمية، صفحة نموذج Fable 5.1 الرسمية. إخراج 300K لدى Opus ينطبق فقط على Batch beta المحدد و header output-300k-2026-03-24، وليس الحد الأعلى لطلبات التفاعل العادية.

تسعير النماذج الأربعة: الإدخال العادي وكتابة الذاكرة المؤقتة والإصابة في الذاكرة هي token مختلفة

جميع القيم في الجدول التالي هي أسعار بالدولار لكل مليون token، وهي سعر الوحدة لفئة الـ token المقابلة. لا يُضاف إلى الإدخال العادي رسم «كتابة الذاكرة المؤقتة»؛ فقط الـ token التي تُكتب في الذاكرة المؤقتة لأول مرة تستخدم سعر الكتابة. بعد إصابة الذاكرة المؤقتة، تُحتسب بسعر القراءة، ويظل الإخراج محتسبًا بشكل منفصل. يقدم كلاهما خصم Batch بنسبة 50% على الإدخال/الإخراج، لكن Batch معالجة غير متزامنة، ولا تناسب محادثات البرمجة التي تحتاج إلى تغذية راجعة فورية.

OpenAI API القياسي GPT-6 Sol GPT-6 Astra
إدخال عادي $2.00 $10.00
كتابة إلى الذاكرة المؤقتة $2.50 $12.50
قراءة من الذاكرة المؤقتة $0.20 $1.00
إخراج $10.00 $50.00
إدخال/إخراج Batch $1.00 / $5.00 $5.00 / $25.00
إدخال يتجاوز 272K الطلب بأكمله: رسوم الإدخال والذاكرة المؤقتة ×2، ورسوم الإخراج ×1.5 الطلب بأكمله: رسوم الإدخال والذاكرة المؤقتة ×2، ورسوم الإخراج ×1.5
إدخال عادي
GPT-6 Sol
$2.00
GPT-6 Astra
$10.00
كتابة إلى الذاكرة المؤقتة
GPT-6 Sol
$2.50
GPT-6 Astra
$12.50
قراءة من الذاكرة المؤقتة
GPT-6 Sol
$0.20
GPT-6 Astra
$1.00
إخراج
GPT-6 Sol
$10.00
GPT-6 Astra
$50.00
إدخال/إخراج Batch
GPT-6 Sol
$1.00 / $5.00
GPT-6 Astra
$5.00 / $25.00
إدخال يتجاوز 272K
GPT-6 Sol
الطلب بأكمله: رسوم الإدخال والذاكرة المؤقتة ×2، ورسوم الإخراج ×1.5
GPT-6 Astra
الطلب بأكمله: رسوم الإدخال والذاكرة المؤقتة ×2، ورسوم الإخراج ×1.5

المصادر: Sol، Astra، جدول أسعار OpenAI، شرح الذاكرة المؤقتة في OpenAI. تجاوز 272K لا يعني إضافة سعر للجزء الزائد فقط؛ يُحتسب عبور الحد وفق إجمالي input token للطلب بأكمله، بما في ذلك الإدخال المرتبط بالذاكرة المؤقتة.

Anthropic API القياسي Claude Opus 5.5 Claude Fable 5.1
إدخال عادي $4.00 $10.00
كتابة إلى الذاكرة المؤقتة لمدة 5 دقائق $5.00 $12.50
كتابة إلى الذاكرة المؤقتة لمدة ساعة واحدة $8.00 $20.00
قراءة من الذاكرة المؤقتة $0.20 $0.25
إخراج $20.00 $50.00
إدخال/إخراج Batch $2.00 / $10.00 $5.00 / $25.00
سياق طويل 1M سعر الوحدة القياسي، دون علاوة >200K سعر الوحدة القياسي، دون علا >200K
إدخال عادي
Claude Opus 5.5
$4.00
Claude Fable 5.1
$10.00
كتابة إلى الذاكرة المؤقتة لمدة 5 دقائق
Claude Opus 5.5
$5.00
Claude Fable 5.1
$12.50
كتابة إلى الذاكرة المؤقتة لمدة ساعة واحدة
Claude Opus 5.5
$8.00
Claude Fable 5.1
$20.00
قراءة من الذاكرة المؤقتة
Claude Opus 5.5
$0.20
Claude Fable 5.1
$0.25
إخراج
Claude Opus 5.5
$20.00
Claude Fable 5.1
$50.00
إدخال/إخراج Batch
Claude Opus 5.5
$2.00 / $10.00
Claude Fable 5.1
$5.00 / $25.00
سياق طويل 1M
Claude Opus 5.5
سعر الوحدة القياسي، دون علاوة >200K
Claude Fable 5.1
سعر الوحدة القياسي، دون علا >200K

المصادر: Opus 5.5، Fable 5.1، أسعار Anthropic وقواعد Batch/الذاكرة المؤقتة، شرح السياق الطويل. تسمح Anthropic صراحةً بجمع خصومات Batch والذاكرة المؤقتة؛ ويجب أن تستوفي إصابة الذاكرة المؤقتة مدة الصلاحية المطابقة وشرط البادئة نفسها.

النتائج المحددة للنماذج الأربعة ضمن نظام التقييم نفسه

الجدول التالي مأخوذ بالكامل من Artificial Analysis Intelligence Index v4.3.2. إعداد الاختبار هو GPT-6 Sol max، وGPT-6 Astra max، وClaude Opus 5.5 وFable 5.1 كلاهما adaptive reasoning max effort مع تفعيل default fallback. هذه ليست الإعدادات الافتراضية للنماذج الأربعة، خصوصًا أن Opus افتراضيًا medium وFable افتراضيًا high؛ وحتى إذا كانت النماذج المختلفة كلها بعلامة max، فإن استهلاك token الاستدلال الفعلي يختلف. توحّد AA المهام وharness الخاص بها، لذلك يمكن النظر إلى النتائج أفقيًا ضمن إعداد الاختبار هذا؛ ولا يمكن خلط نتائج إعلانات الشركات في هذا الجدول. الروابط: مقارنة Sol–Opus الأصلية، مقارنة Astra–able الأصلية، منهجية AA.

م AA الشاملة والهندسية Sol Opus 5.5 Astra Fable 5.1
المؤشر الشامل v4.3.2 (نقطة) 48 58 53 53
Terminal-Bench 4.0 (معدل النجاح) 44% 60% 59% 52%
AutomationBench-AA (معدل النجاح) 62% 70% 68% 59%
SciCode (معدل النجاح) 58% 67% 56% 63%
AA-LCR v1.1 السياق الطويل (معدل النجاح) 84% 85% 81% 85%
المؤشر الشامل v4.3.2 (نقطة)
Sol
48
Opus 5.5
58
Astra
53
Fable 5.1
53
Terminal-Bench 4.0 (معدل النجاح)
Sol
44%
Opus 5.5
60%
Astra
59%
Fable 5.1
52%
AutomationBench-AA (معدل النجاح)
Sol
62%
Opus 5.5
70%
Astra
68%
Fable 5.1
59%
SciCode (معدل النجاح)
Sol
58%
Opus 5.5
67%
Astra
56%
Fable 5.1
63%
AA-LCR v1.1 السياق الطويل (معدل النجاح)
Sol
84%
Opus 5.5
85%
Astra
81%
Fable 5.1
85%

مصادر القيم في كل صف هي صفحتا مقارنة النماذج نفسها من AA المذكورتان أعلاه: صفحة مقارنة AA وصفحة Astra–Fable. على سبيل المثال، في harness Terminal-Bench 4.0 الخاص بـ AA نفسه، يتفوق Opus 5.5 على Sol بـ 16 نقطة مئوية؛ ولا يمكن خلط ذلك مع 66.4% الواردة في موقع Anthropic الرسمي، إذ تختلف إعدادات التشغيل.

مهام AA المعرفية والمهنية Sol Opus 5.5 Astra Fable 5.1
AA-Briefcase v1.1 (Elo) 1483 1822 1569 1678
GDPval-AA v2.1 (Elo) 1487 1846 1542 1735
Humanity's Last Exam (معدل النجاح) 48% 61% 55% 59%
GDP.pdf (معدل النجاح الكامل) 25% 26% 31% 26%
CritPt (معدل النجاح) 31% 32% 32% 30%
AA-Omniscience (نقاط المؤشر، وليست نسبة مئوية) 27 46 43 43
AA-Briefcase v1.1 (Elo)
Sol
1483
Opus 5.5
1822
Astra
1569
Fable 5.1
1678
GDPval-AA v2.1 (Elo)
Sol
1487
Opus 5.5
1846
Astra
1542
Fable 5.1
1735
Humanity's Last Exam (معدل النجاح)
Sol
48%
Opus 5.5
61%
Astra
55%
Fable 5.1
59%
GDP.pdf (معدل النجاح الكامل)
Sol
25%
Opus 5.5
26%
Astra
31%
Fable 5.1
26%
CritPt (معدل النجاح)
Sol
31%
Opus 5.5
32%
Astra
32%
Fable 5.1
30%
AA-Omniscience (نقاط المؤشر، وليست نسبة مئوية)
Sol
27
Opus 5.5
46
Astra
43
Fable 5.1
43

مصادر القيم في كل صف: AA Sol–Opus، AA Astra–Fable. الفروق الصغيرة من 1–2 نقطة مئوية لا ينبغي تفسيرها كانتصار مستقر؛ كما أن Elo ونقاط المؤشر ومعدل النجاح ليست الوحدة نفسها.

تكلفة واستهلاك اختبار AA Sol Opus 5.5 Astra Fable 5.1
متوسط التكلفة لكل مهمة في المؤشر $1.06 $5.98 $3.26 $7.63
متوسط output token لكل مهمة 31K 119K 27K 78K
منها reasoning token 21K 84K 17K 47K
متوسط التكلفة لكل مهمة في المؤشر
Sol
$1.06
Opus 5.5
$5.98
Astra
$3.26
Fable 5.1
$7.63
متوسط output token لكل مهمة
Sol
31K
Opus 5.5
119K
Astra
27K
Fable 5.1
78K
منها reasoning token
Sol
21K
Opus 5.5
84K
Astra
17K
Fable 5.1
47K

المصادر لا تزال AA Sol–Opus وAA Astra–Fable. تكلفة المهمة هي متوسط مرجّح لاستهلاك اختبار AA، وليست عرض سعر لـ «إنجاز متطلب واحد» في مستودعك. يستهلك إعداد max في Opus مزيدًا من output token وreasoning token، وهذا أحد أسباب كون الفرق في الفاتورة أكبر من فرق سعر الوحدة.

الرسوم البيانية على موقعي الشركتين: تتحقق من استنتاج كل منهما، لكنها لا تُجمّع لتحديد فائز في المواجهة نفسها

يعرض مخطط DeepSWE v1.1 من OpenAI أن GPT-6 Sol max يحقق 68.8%، بينما يحقق Claude Fable 5 بإعداد xhigh نسبة 69.9%؛ ولا يظهر Opus 5.5. المحور الأفقي هو التكلفة لكل مهمة، بمقياس لوغاريتمي. كما أن Opus 5 في المخطط ليس Opus 5.5. يوضح ذلك أن Sol، في الإعدادات المعلنة من OpenAI، يحقق نتائج وكيل برمجة قريبة من نماذج الفئة العليا، لكنه لا يغني عن اختبار الموديلات الأربعة في المواجهة نفسها.

مخطط DeepSWE v1.1 الرسمي من OpenAI: GPT-6 Sol max يحقق 68.8%، ولا يظهر Opus 5.5 في المخطط

الشكل 1: OpenAI «Introducing GPT-6 Sol and Luna» «Coding»، 2026-09-22. يُعتمد على مفتاح الرسم وحواشي النص الأصلي لتحديد النماذج وeffort. افتح الصورة الكاملة لقراءة النص الصغير.

يعرض مخطط Terminal-Bench 4.0 من Anthropic أن Claude Opus 5.5 بإعداد xhigh يحقق 66.4%. أما GPT-6 Astra في المخطط فيحقق 57.9% باستخدام high، وليس GPT-6 Sol. يحتوي المنحنى أيضًا على نقاط effort الافتراضي، لكن لا يمكن اعتبار موضعها نتيجة xhigh. إن harness الشركة هنا يختلف عن Terminal-Bench 4.0 في جدول AA أعلاه، ولا يمكن طرح 44% التي منحتها AA لـ Sol من 66.4%.

مخطط Terminal-Bench 4.0 الرسمي من Anthropic: Opus 5.5 xhigh يحقق 66.4%، ولا يظهر GPT-6 Sol في المخطط

الشكل 2: Anthropic «Claude Opus 5.5» «Coding»، 2026-09-22. المحور الأفقي هو التكلفة لكل محاولة، بمقياس لوغاريتمي؛ راجع النص الأصلي لمعرفة الإعدادات المعروضة وفترات الثقة والقيود. افتح الصورة الكاملة لقراءة النص الصغير.

وهناك أيضًا نتائج معلنة من شركة واحدة لا ينبغي طرحها مباشرة: أعلنت OpenAI أن Sol xhigh يحقق في AutomationBench 1.0.6 نسبة 33.2%، وأن max يحقق في Agents' Last Exam V1 نسبة 56.4%، وأن xhigh يحقق في OSWorld 2.0 offline نسبة 60.5%، والمصدر هو صفحة إعلان OpenAI نفسها؛ وأعلنت Anthropic أن Opus 5.5 يحقق في FrontierCode v1.1 Main نسبة 54.4%، وفي CursorBench 4.0 نسبة 57.8%، وفي GDPval-AA v2.1 نتيجة 1846 Elo، وفي Humanity's Last Exam with tools نسبة 67.7%، والمصدر هو صفحة إان Anthropic نفسها. لم يُثبت أن إصدارات هذه العناصر أو أدواتها أو effort أو harness لديها متطابق مع الطرف الآخر، لذلك لا نذكر «مقدار التقدم». ولا يمكن تخمين القيم غير المعلنة للنماذج الأربعة بالمعيار نفسه.

كم ستدفع لكمية المهام نفسها؟ خمسة أمثلة قابلة لإعادة الحساب

في ما يلي، نقسّم الإدخال إلى ثلاث فئات token متنافية: إدخال عادي، وكتابة أولى إلى الذاكرة المؤقتة، وقراءة لاحقة من الذاكرة المؤقتة، ثم نضيف الإخراج. كل صف هو طلب واحد، ولا يشمل استدعاءات الأدوات أو رسوم المنصة الإضافية أو جولات إضافية؛ وجميع كميات الإخراج أقل من الحد الأعلى 128K للطلبات العادية. حُسبت الأسعار وفق الأسعار الرسمية أعلاه، لذا يمكن استبدال أعداد token وفق سجلات usage الخاصة بك.

السيناريو واستهلاك token Sol Opus 5.5 Astra Fable 5.1
A عادي: 100K إدخال جديد + 50K إخراج $0.70 $1.40 $3.50 $3.50
B كتابة أولى إلى الذاكرة المؤقتة: 200K كتابة + 50K إدخال جديد + 20K إخراج $0.80 $1.60 (5m) / $2.20 (1h) $4.00 $4.00 (5m) / $5.50 (1h)
C إصابة لاحقة: 200K قراءة من الذاكرة المؤقتة + 50K إدخال جديد + 20K إخراج $0.34 $0.64 $1.70 $1.55
D نسخة Batch غير المتزامنة من A: 100K إدخال جديد + 50K إخراج $0.35 $0.70 $1.75 $1.75
E إدخال طويل: 300K إدخال جديد + 20K إخراج $1.50 $1.60 $7.50 $4.00
A عادي: 100K إدخال جديد + 50K إخراج
Sol
$0.70
Opus 5.5
$1.40
Astra
$3.50
Fable 5.1
$3.50
B كتابة أولى إلى الذاكرة المؤقتة: 200K كتابة + 50K إدخال جديد + 20K إخراج
Sol
$0.80
Opus 5.5
$1.60 (5m) / $2.20 (1h)
Astra
$4.00
Fable 5.1
$4.00 (5m) / $5.50 (1h)
C إصابة لاحقة: 200K قراءة من الذاكرة المؤقتة + 50K إدخال جديد + 20K إخراج
Sol
$0.34
Opus 5.5
$0.64
Astra
$1.70
Fable 5.1
$1.55
D نسخة Batch غير المتزامنة من A: 100K إدخال جديد + 50K إخراج
Sol
$0.35
Opus 5.5
$0.70
Astra
$1.75
Fable 5.1
$1.75
E إدخال طويل: 300K إدخال جديد + 20K إخراج
Sol
$1.50
Opus 5.5
$1.60
Astra
$7.50
Fable 5.1
$4.00

مثال حسابي: Sol في A = 0.1×$2 + 0.05×$10 = $0.70. Opus 5m في B = 0.2×$5 + 0.05×$4 + 0.02×$20 = $1.60؛ Opus في C = 0.2×$0.20 + 0.05×$4 + 0.02×$20 = $0.64. إدخال Sol في E هو 300K وقد تجاوز 272K، لذا يُحسب الطلب بأكمله بسعر إدخال $4 وإخراج $15؛ ويقابله في Astra $20/$75. يحافظ سياق 1M لدى Opus/Fable على سعر الوحدة القياسي. B وC طلبان مختلفان: كتابة أولى ثم قراءة لاحقة؛ ويجب أن تتأكد في C من أن الذاكرة المؤقتة ما زالت صالحة. تختلف مدة الاحتفاظ بالذاكرة المؤقتة لدى OpenAI وآلية تسعير 5m/1h لدى Anthropic، ولا يجوز إضافة رسم الكتابة في B خطأً إلى كل طلب في C. الاستناد: أسعار نموذجي OpenAI، قواعد أسعار Anthropic.

عند دمجها في سير عمل البرمجة الفعلي، كيف نوزّع الأدوار؟

ابدأ بـ Sol في التكرارات اليومية. تفكيك المتطلبات، والتعديلات الصغيرة في مستودع قائم، ورقعات الاختبار، والأعمال القابلة للمراجعة بالجملة، اتركها أولاً لـ Sol، ثم سجّل معدل نجاح المهام وعدد مرات إعادة العمل وإجمالي token. يظهر سعر وحدته المنخفض بأكثر مباشرة في أمثلة A–D التي لا تتجاوز 272K؛ أما في الطلبات الطويلة جدًا فتتقلص ميزة السعر.

يتولى Opus 5.5 مهام الوكيل التي يصعب أن تصل إلى نتيجة من المحاولة الأولى. تمنحه اختبارات AA في المواجهة نفسها نتائج أعلى في المهام الشاملة والطرفية والمعرفية، لكن متوسط تكلفة المهمة في إعداد max أعلى بوضوح أيضًا. يمكنك أولاً بناء خط أساس محلي باستخدام medium الافتراضي أو effort الذي تستخدمه فعليًا، ثم رفع الإعداد للمهام الصعبة. لا تعامل نتائج max لدى AA كتجربة افتراضية.

Astra وFable 5.1 هما فئتا الارتقاء. يقدم Astra أداءً منافسًا في AutomationBench-AA وTerminal-Bench 4.0 وGDP.pdf لدى AA، وتتفوق Fable 5.1 في بعض مؤشرات العمل المعرفي الطويل المدى، لكن سعر الإدخال/الإخراج الأساسي $10/$50 لكل منهما أعلى بكثير من Sol. قراءة الذاكرة المؤقتة لدى Fable هي $0.25، أقل من $1.00 لدى Astra؛ وإذا تكررت قراءة بادئة كبيرة، فقد يتغير ترتيب التكلفة. للمهام الصعبة جدًا، يُنصح بإجراء قبول بعينة صغيرة للنماذج الأربعة على متطلب المستودع نفسه، والاختيار وفق «تكلفة المهمة المكتملة بنجاح والقابلة للدمج»، لا وفق درجة قائمة تصنيف واحدة.

في PandaNpc، يُعد Codex وClaude Code محركي Agent متاحين. عند اختيار نقطة الدخول، يجب أيضًا مراعاة اشتراكك الحالي أو قناة API، وأذونات الأدوات، وسياق المستودع، وعملية مراجعة الفريق؛ ولا يمكن تحويل أسعار API للنماذج مباشرة إلى حصة اشتراك الأداة. يعرض هذا المقال مواصفات وتقييمات عامة، ولا يدّعي وجود ترتيب فعلي للنماذج الأربعة داخل PandaNpc.

الأسئلة الشائعة (FAQ)

هل Sol أرخص دائمًا بنصف سعر Opus 5.5؟ فقط سعر الوحدة للإدخال والإخراج في API القياسي هو نصف السعر في كل منهما. إن تجاوز الإدخال 272K، وكتابة/قراءة الذاكرة المؤقتة، وreasoning token الفعلية، وعدد الجولات، ورسوم الأدوات، كلها تغيّر فاتورة المهمة بأكملها. السيناريو E أعلاه قرّب سعر الطلب الواحد لكليهما إلى $1.50 و$1.60.

هل يثبت المخططان الرسميان للبرمجة من الفائز؟ لا. مخطط OpenAI لا يضم Opus 5.5، ومخطط Anthropic لا يضم Sol، كما أن المعيار وharness مختلفان. لرؤية نتائج النماذج الأربعة في المواجهة نفسها، انظر إلى جدول الإعداد الثابت في AA v4.3.2؛ ولاتخاذ قرار بشأن اختيار أداتك، أعد تشغيل مهام مستودعك الخاصة.

هل يمكن الجمع بين الذاكرة المؤقتة وBatch؟ تدعم وثائق أسعار Anthropic الجمع صراحةً؛ أما إصابة الذاكرة المؤقتة فعليًا فتعتمد على البادئة ومدة الصلاحية وإعدادات الطلب. يساوي Batch لدى نموذجي OpenAI 50% من السعر القياسي؛ وللتحقق من الفاتورة المحددة، راجع سجلات استخدام API المقابلة.

مقارنة GPT-6 Astra وClaude Fable 5.1: البرمجة والوكلاء والسعر ونتائج المعايير

مقارنة GPT-6 Astra وClaude Fable 5.1: البرمجة والوكلاء والسعر ونتائج المعايير

كل من GPT-6 Astra وClaude Fable 5.1 متاحان للاستخدام العام، وكلاهما نماذج رائدة بسعر 10 دولارات لكل مليون توكن إدخال و50 دولارًا لكل مليون توكن إخراج، لكن لكلٍ منهما مفاضلات في البرمجة، والتحكم في الكمبيوتر، والمهام الطويلة، وتكلفة التخزين المؤقت، والسياق. تقارن هذه المقالة بينهما بندًا ببند باستخدام معيار مشترك، وتقدم طريقة لاختيار النموذج وفقًا للمهمة.

اقرأ المقال →
Codex لتفعيل سياق Sol 1M الخاص بـ GPT-5.6: دليل إعداد `config.toml` في 3 أسطر

Codex لتفعيل سياق Sol 1M الخاص بـ GPT-5.6: دليل إعداد `config.toml` في 3 أسطر

يدعم GPT-5.6 Sol رسميًا سياقًا يبلغ 1.05 مليون توكن. فقط أضف 3 أسطر من الإعدادات أعلى ملف config.toml الخاص بـ Codex لتشغيله بنافذة مليون توكن، مع ضغط تلقائي للتاريخ عند حوالي 900 ألف توكن. مرفق إعداد دائم، وأمر لمرة واحدة، والتحقق، وتذكير بالتكلفة.

اقرأ المقال →
التحليل الشامل لـ Claude Fable 5.1: المعايير والتحسينات والسعر والسرعة

التحليل الشامل لـ Claude Fable 5.1: المعايير والتحسينات والسعر والسرعة

النتائج الكاملة لـ Claude Fable 5.1 على 7 فئات من المعايير الرئيسية، مقارنةً بندًا بندًا مع Fable 5 وOpus 5 وGPT-5.6 Sol، مع شرح المهام الطويلة واستدعاء الأدوات وتكاليف التخزين المؤقت والسرعة وقيود الباقات وتغييرات الترحيل في 5.1.

اقرأ المقال →