نماذج جديدة · مُختبَرة
هل يلتقط Opus 5.5 رقماً خاطئاً في رسم بياني مولَّد بالذكاء الاصطناعي؟

تقول Anthropic إن Claude Opus 5.5 يحقق 89.0% في Chartography، وهو اختبار لقراءة الرسوم البيانية، مع استخدام الأدوات. ولكل من يصنع شرائح العرض بمولّد صور، يطرح ذلك سؤالاً عملياً: هل يستطيع النموذج فحص الأرقام قبل أن تُعرض الشريحة؟
في 23 سبتمبر 2026 أخذنا شريحة رسم بياني حقيقية صُنعت في Ciyo، وغيّرنا رقماً مطبوعاً واحداً، وطلبنا من Opus 5.5 وGPT-6 Sol العثور عليه. ثم أعطيناهما الشريحة غير المعدّلة لنرى أيهما سيطلق إنذاراً بلا سبب.
الشرائح
الشريحة الأصلية رسم بياني بالأعمدة لمقهى Pier Six Coffee المتخيَّل، صُنع في Ciyo في 21 سبتمبر. وقد قسناه حينها: الأرقام الأربعة المطبوعة، 320 و410 و380 و505، طابقت ارتفاعات أعمدتها في حدود 1%.
وفي نسخة الاختبار غيّرنا فقط تسمية الأسبوع 3 من 380 إلى 430 وتركنا العمود كما هو. ورُفع الملفان كلاهما باسم محايد هو sales-chart.png، فلم يكشف اسم الملف شيئاً.

السؤال
تلقى النموذجان التعليمات نفسها بمستوى جهد Medium: اقرأ كل عمود من ارتفاعه، وقارنه بالرقم المطبوع، وأدرج أي تعارض مع مقدار الفرق.
صنع مولّد صور بالذكاء الاصطناعي شريحة الرسم البياني بالأعمدة هذه. لكل عمود، اقرأ قيمته من ارتفاعه مقارنة بخطوط الشبكة على المحور الرأسي. ثم أخبرني هل يطابق كل رقم مطبوع فوق عمود ارتفاعَ ذلك العمود. أدرج أي تعارض مع الرقم المطبوع، وقراءتك للارتفاع، ومقدار الفرق.التقط كلاهما الخطأ المزروع
عثر عليه Opus 5.5: الأسبوع 3 مطبوع عليه 430، ويُقرأ عند نحو 380، بفرق يقارب 50، والعمود بوضوح تحت خط 400. وأضاف النقطة الأهم لأي عرض تقديمي: التسمية الخاطئة تحوّل انخفاضاً في الأسبوع 3 إلى نمو ثابت. ونصح بمراجعة البيانات المصدرية، لأن الصورة وحدها لا تستطيع أن تحدد هل التسمية هي الصحيحة أم العمود.
وعثر GPT-6 Sol على الخطأ نفسه بالقراءة نفسها، في إجابة أقصر ودون التعليق على الاتجاه.

إجابة Sol
أدرج جدول Sol التعارض وحده: الأسبوع 3، مطبوع 430، ويُقرأ عند نحو 380، أي أعلى بنحو 50. ولفحص سريع جوابه نعم أو لا، هذا الإيجاز ميزة.

اختبار الإنذار الكاذب
الفاحص الذي ينبّه إلى كل شيء ليس فاحصاً. على الشريحة غير المعدّلة، أفاد Opus بعدم وجود أي تعارض، وقال إنه لا يستطيع قراءة الارتفاعات إلا في حدود ±5 تقريباً مع خطوط شبكة كل 100 وحدة. أما Sol فعلّم الأسبوع 1 بوصفه تعارضاً، إذ قرأه عند نحو 325 مقابل 320.
لم يكن Sol يتوهم: فقياسنا بالبكسل يضع ذلك العمود عند نحو 323. لكن ثلاث وحدات أقل مما تستطيع خطوط الشبكة إظهاره، لذا فهذا التنبيه على شريحة حقيقية يرسلك للبحث عن خطأ غير موجود.
| الشريحة | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|
| المعدّلة (الأسبوع 3 = 430) | التقطه، ≈380، ولاحظ الاتجاه | التقطه، ≈380 |
| الأصلية (كلها صحيحة) | لا تعارض، وذكر ±5 | علّم الأسبوع 1 (≈325 مقابل 320) |

كيف تستخدم هذا قبل اجتماع
أبقِ الأرقام في جدول بياناتك، ودع مولّد الصور يرسم الشريحة من حولها. ثم ارفع الشريحة المكتملة إلى نموذج مثل Opus 5.5 واطلب منه قراءة الأعمدة. يستغرق ذلك أقل من دقيقة، ويلتقط الخطأ الذي يهم: تسمية تروي قصة مختلفة عما يرويه العمود.
لا يشغّل Ciyo نموذج Claude Opus 5.5 ولا GPT-6 Sol. يمكنك صنع الشريحة في Ciyo وفحصها في أي من النموذجين.
الرسوم البيانية تخطئ في هذا علناً أيضاً
قدّم أسبوع الإطلاق مثاله الخاص على رسم بياني كان يحتاج إلى فحص.
نُشر في 2026-09-22 من شخص يصف نفسه بأنه مبرمج ومصمم يعمل بالذكاء الاصطناعي. يرسم الرسم البياني المرفق معدل النجاح بحسب مستوى الجهد لعدة نماذج، ومحوره الأفقي بلا مقياس ولا تسمية، وهو ما يسميه صاحب المنشور جريمة بحق الرسوم البيانية. لا يذكر المنشور مصدر الرسم البياني؛ وهو ليس رسم AutomationBench البياني المنشور في صفحة إعلان Anthropic، الذي يحمل محوراً مسمّى للتكلفة.
فحص الرسوم البيانية مع Opus 5.5
هل يستطيع Claude Opus 5.5 قراءة الأرقام من صورة رسم بياني؟
في اختبارنا قرأ ارتفاعات أربعة أعمدة في حدود خمس وحدات تقريباً، والتقط تسمية كنا قد غيّرناها بمقدار 50.
هل أدى GPT-6 Sol بالمستوى نفسه؟
التقط الخطأ نفسه، لكنه عدّ فرقاً بثلاث وحدات على الشريحة غير المعدّلة تعارضاً.
هل ينبغي أن يرسم الذكاء الاصطناعي رسمي البياني؟
ارسم الرسوم البيانية من بياناتك، ثم استخدم مولّد الصور للشريحة المحيطة بها. وافحص أي رسم بياني يرسمه مولّد.
هل يشغّل Ciyo نموذج Opus 5.5؟
لا. يقدّم وكيل Ciyo نموذجي Ciyo Agent وGPT-6 Astra. اصنع الشريحة في Ciyo وافحصها في النموذج الذي تفضّله.
اصنع الشريحة، وأبقِ الأرقام صادقة
ولّد فنون الشرائح في Ciyo، وأبقِ البيانات في جدول بياناتك، وافحص أي شيء يرسمه مولّد.