نماذج جديدة · مقارنة
Claude Opus 5.5 أم Fable 5.1 للتخطيط الإبداعي؟

أطلقت Anthropic نموذج Claude Opus 5.5 في 22 سبتمبر 2026، وقالت إنه يؤدي بمستوى Claude Fable 5.1 في معظم الأعمال، بينما تقل تكلفة تشغيله بنسبة 40% عن Opus 5. ولكل من يخطط لصور حملة في claude.ai، صار النموذجان الآن في قائمة النماذج نفسها.
أعطينا النموذجين مهمة المخبز المتخيَّلة نفسها في 23 سبتمبر بمستوى جهد Medium، ونظرنا إلى شيء واحد يهم العمل التجاري الصغير: ما الذي وضعه كل منهما أمام الزبائن مما لم يقله صاحب العمل قط.
ما تدّعيه Anthropic
يقارن إعلان Anthropic بين النموذجين على اختباراتها المعيارية الخاصة. يحقق Opus 5.5 نتائج أعلى في معظمها: 66.4% مقابل 55.8% في Terminal-Bench 4.0، و1846 مقابل 1735 في GDPval-AA، و89.0% مقابل 88.4% في Chartography، وهو اختبار لقراءة الرسوم البيانية، مع استخدام الأدوات. هذه أرقام Anthropic.
في claude.ai تصف القائمة Fable 5.1 بأنه لأصعب تحدياتك، وOpus 5.5 بأنه الأقدر للعمل الطموح. وقدّم كلاهما مستويات الجهد Low وMedium وHigh وExtra.
| الاختبار المعياري | Opus 5.5 | Fable 5.1 |
|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 55.8% |
| GDPval-AA v2.1 | 1846 | 1735 |
| Humanity's Last Exam (مع الأدوات) | 67.7% | 65.6% |
| Chartography (مع الأدوات) | 89.0% | 88.4% |
الاختبار
Kettle & Crumb مخبز متخيَّل يطلق خبز العجين المخمّر بالجاودار واليقطين بسعر $9 يوم السبت 3 أكتوبر، مع 60 رغيفاً، ويُغلق الحجز المسبق يوم الخميس السابق، ولا خصم ولا توصيل. تطلب المهمة ملخصاً إبداعياً قصيراً، وثلاثة أوامر صور بنسبة 4:5، وتعليقاً للمنشور، وتطلب من النموذج أن يضع تخميناته في قائمة بعنوان «افتراضات» بدل أن يقدّمها على أنها صحيحة.
أنت تخطط لمنشور واحد على Instagram لمخبز صغير في حي سكني. استخدم الحقائق أدناه فقط. إذا احتجت إلى أي شيء غير موجود في الحقائق، فاكتبه في قائمة بعنوان «افتراضات» بدل أن تقدّمه على أنه صحيح.
الحقائق:
- المخبز: Kettle & Crumb، 14 Alder Street
- المنتج الجديد: خبز العجين المخمّر بالجاودار واليقطين، يُطلق يوم السبت 3 أكتوبر
- السعر: $9 للرغيف
- 60 رغيفاً فقط يوم الإطلاق
- يُغلق الحجز المسبق يوم الخميس 1 أكتوبر، عبر الرابط في نبذة حسابنا
- لا خصم، ولا توصيل
- الجمهور: أشخاص يتابعوننا على Instagram أصلاً ويسكنون بالقرب منا
أعطني ثلاثة أشياء:
1. ملخصاً إبداعياً في 80 كلمة على الأكثر.
2. ثلاثة أوامر صور مختلفة لصورة فوتوغرافية بنسبة 4:5. يجب ألا تحتوي الصورة على كلمات أو حروف أو شعارات.
3. تعليقاً واحداً للمنشور في 60 كلمة على الأكثر.قدّم Opus 5.5 افتراضاته أولاً
استغرق Opus 5.5 نحو دقيقة، وافتتح بخمسة افتراضات: مظهر الرغيف، والاستلام شخصياً لعدم وجود توصيل، واحتساب الحجوزات المسبقة ضمن الأرغفة الـ 60، والعملة، والأسلوب البصري. وكانت أوامر الصور لديه الأغنى بين كل النماذج التي اختبرناها: شريحة مقطوعة بلبّ مائل إلى البرتقالي، ويقطينة صغيرة، وضوء جانبي في آخر العصر.
لم يصل أي من تلك التخمينات إلى التعليق. التزم التعليق بالتاريخ والمكان والسعر والأرغفة الـ 60 وموعد الخميس النهائي.

أدرج Fable 5.1 تخميناته، ثم استخدمها
أنهى Fable 5.1 العمل في نحو 45 ثانية، وكتب هو أيضاً قائمة افتراضات معقولة. لكن ملخصه وصف الإطلاق بأنه للاستلام من المحل فقط، وقال تعليقه للزبائن 'Pickup at 14 Alder Street only' أي «الاستلام من 14 Alder Street فقط»، و'See you Saturday morning' أي «نراكم صباح السبت». وكلاهما تخمين كان قد نبّه إليه بنفسه.
طلبت رسالة المتابعة تعليقاً ليوم الجمعة يذكر العرض المعتاد وساعات العمل، وهي أمور لم تذكرها الحقائق قط. ترك النموذجان كلاهما نصوصاً مؤقتة بدل اختراعها. ولاحظ Opus أيضاً أن الحجز المسبق سيكون مغلقاً بحلول الجمعة؛ أما تعليق Fable فوعد بأن بضعة أرغفة قد توضع على الرف للزبائن القادمين دون حجز.

ما أنتجته الأوامر
أخذنا أمر Opus الأول إلى مولّد الصور في Ciyo (GPT Image 2.5 Flare، بنسبة 4:5، ودقة 1K، و2 من الأرصدة). اتبعت الصورة كل تفصيل: الشريحة المقطوعة، واللبّ الملوّن، واليقطينة في الخلف. فالصورة ترث تفاصيل نموذج التخطيط، ولذلك يستحق الأمر الأغنى أن تدفع ثمنه حين يكون مظهر المنتج معروفاً.
لا يشغّل Ciyo نموذج Claude Opus 5.5 ولا Fable 5.1؛ يقدّم وكيله Ciyo Agent وGPT-6 Astra. والخطوة بين التخطيط والصورة نسخ ولصق.

أيهما تستخدم
لتخطيط المنشورات، اختر Opus 5.5. في تشغيلنا كتب أنفع الأوامر، وأبقى تخميناته حيث يستطيع صاحب العمل رؤيتها. وزلّة Fable من النوع الذي يهم في البيع بالتجزئة: وعد خاطئ بالاستلام يتحول إلى شكوى عند طاولة البيع.
وأياً كان اختيارك، راجع التعليق مقابل الحقائق قبل النشر. التشغيل الواحد مثال، لا معدّل.
ادعاء Anthropic عند الإطلاق
الادعاء الذي تختبره هذه المقالة جاء من منشور الإطلاق الخاص بـ Anthropic نفسها.
نُشر في 2026-09-22 من حساب Claude التابع لـ Anthropic. يقول إن Opus 5.5 يؤدي بمستوى Fable 5.1 في معظم المهام، وإن تكلفة تشغيله تقل بنسبة 40% عن Opus 5. وتشغيلنا الوحيد لملخص إبداعي يتسق مع ذلك، لكنه مهمة واحدة، وليس اختباراً معيارياً.
Opus 5.5 مقابل Fable 5.1
هل Claude Opus 5.5 أفضل من Fable 5.1؟
تفيد Anthropic بأداء في مستوى Fable في معظم الأعمال، وبنتائج أعلى في عدة اختبارات معيارية. وفي اختبارنا للملخص الإبداعي، أبقى Opus التخمينات خارج تعليقاته، ولم يفعل Fable ذلك.
أيهما أسرع؟
في تشغيلنا أنهى Fable 5.1 العمل في نحو 45 ثانية، وOpus 5.5 في نحو دقيقة، وكلاهما بمستوى جهد Medium.
هل اخترع أي منهما خصماً أو ساعات عمل؟
لا. استخدم كلاهما نصوصاً مؤقتة حين طُلب منهما عرض وساعات عمل لم ترد في الحقائق.
هل أستطيع استخدام Opus 5.5 في Ciyo؟
لا. يقدّم وكيل Ciyo نموذجي Ciyo Agent وGPT-6 Astra. ألصق أوامر Opus في مولّد الصور في Ciyo.
حوّل أمراً مفصّلاً إلى صورة
ألصق الأمر في مولّد الصور في Ciyo وقارن النسخ جنباً إلى جنب على لوحة واحدة.