نموذجا ذكاء اصطناعي صينيان يحلّان مسائل أولمبياد الرياضيات بلا خطأ

42 نقطة تضعهما بمستوى أصحاب العلامة الكاملة من المتنافسين البشر

خضع النموذجان لتقييم منفصل بعد انتهاء مسابقة الطلاب ولم يشاركا ضمن الترتيب الرسمي للأولمبياد (أدوبي)
خضع النموذجان لتقييم منفصل بعد انتهاء مسابقة الطلاب ولم يشاركا ضمن الترتيب الرسمي للأولمبياد (أدوبي)
TT

نموذجا ذكاء اصطناعي صينيان يحلّان مسائل أولمبياد الرياضيات بلا خطأ

خضع النموذجان لتقييم منفصل بعد انتهاء مسابقة الطلاب ولم يشاركا ضمن الترتيب الرسمي للأولمبياد (أدوبي)
خضع النموذجان لتقييم منفصل بعد انتهاء مسابقة الطلاب ولم يشاركا ضمن الترتيب الرسمي للأولمبياد (أدوبي)

أعلنت شركتا «هواوي» و«شياوهونغشو» الصينيتان أن نظاميهما للذكاء الاصطناعي حصلا على العلامة الكاملة في مسائل أولمبياد الرياضيات الدولي لعام 2026، بعدما قدّم كل منهما حلولاً للمسائل الست التي واجهها المتنافسون البشر في دورة هذا العام.

ووفق بيان للشركتين، سجل نظام «سيليا» التابع لـ«هواوي»، ونموذج «dots-note-3.0» الذي طورته «شياوهونغشو»، 42 نقطة من أصل 42، بواقع سبع نقاط لكل مسألة. ولم يشارك النظامان ضمن المسابقة الرسمية المخصصة للطلاب، إذ تسلّمت الشركات المسائل بعد انتهاء المتنافسين البشر من الاختبار، ثم قُدمت الحلول ضمن عملية تقييم منفصلة.

ست مسائل كاملة

يتطلب أولمبياد الرياضيات الدولي من المشاركين حل ست مسائل موزعة على يومين، ولا تكفي فيه الإجابة النهائية وحدها، بل يجب تقديم برهان متكامل يوضح الخطوات المنطقية المؤدية إلى النتيجة. ولهذا تحمل العلامة الكاملة دلالة تتجاوز القدرة على إجراء الحسابات، إذ تعني أن الحلول استوفت متطلبات البرهان وفق عملية التصحيح.

وقالت «شياوهونغشو» إن نموذجها حصل على النقاط السبع كاملة في كل واحدة من المسائل الست بعد تصحيح نظمته لجنة المسابقة. وأوضحت أن أي تدخل بشري خلال الاختبار كان ممنوعاً، بما في ذلك تقديم التلميحات أو تعديل الإجابات أو الاختيار بين حلول متعددة أنتجها النظام.

كما أعلنت «هواوي» أن نظام «سيليا» أظهر قدرات شاملة في حل مسائل تنتمي إلى مجالات رياضية مختلفة. إلا أن النتائج المعلنة تخص إجابات الذكاء الاصطناعي على ورقة المسابقة، ولا تعني أن النظامين فازا رسمياً بالأولمبياد أو نافسا الطلاب ضمن ترتيب واحد.

سجّل سبعة متنافسين من البشر أيضاً العلامة الكاملة لذلك لا تعني النتيجة أن النموذجين تفوقا على جميع المشاركين (أدوبي)

سبعة طلاب فقط

استضافت شنغهاي الدورة السابعة والستين من أولمبياد الرياضيات الدولي بين 10 و21 يوليو (تموز) 2026، بمشاركة 666 طالباً من 117 دولة. وأظهرت النتائج الرسمية أن سبعة متنافسين فقط من البشر حققوا العلامة الكاملة البالغة 42 نقطة، فيما حُدد الحد الأدنى للميدالية الذهبية عند 29 نقطة.

وحصل 55 طالباً على الميدالية الذهبية، و105 على الفضية، و189 على البرونزية، إلى جانب 141 تنويهاً شرفياً. وتضع هذه الأرقام الأداء المعلن للنموذجين عند مستوى أعلى نتيجة ممكنة في ورقة المسابقة، لكنه يظل ناتجاً عن تقييم منفصل جرى بعد تسليم المسائل إلى المختبرات التقنية.

ولا يصح بناءً على ذلك القول إن الذكاء الاصطناعي «تفوق على جميع البشر»، لأن سبعة طلاب حققوا النتيجة نفسها. كما أن عدداً آخر من المختبرات قد يعلن لاحقاً نتائج لنماذجه على المسائل ذاتها.

قفزة خلال عام

تمثل نتيجة 2026 تقدماً مقارنة بما أعلنته مختبرات الذكاء الاصطناعي خلال الدورة السابقة. ففي عام 2025، حققت نسخة متقدمة من «Gemini Deep Think» التابعة لـ«غوغل ديب مايند» 35 نقطة، بعدما حلت خمساً من المسائل الست بصورة كاملة، وهو مستوى يعادل الميدالية الذهبية في تلك الدورة.

ويكشف الانتقال من خمس مسائل محلولة إلى ست مسائل كاملة خلال عام عن تطور متسارع في قدرة النماذج على التعامل مع سلاسل طويلة من الاستدلال، ومراجعة الفرضيات، وإنتاج براهين قابلة للتقييم البشري.

ولا يعتمد هذا النوع من الأداء بالضرورة على إجابة واحدة يولدها نموذج لغوي مباشرة. فأنظمة حل المسائل المتقدمة قد تستخدم عمليات بحث متعددة، وتجرب مسارات مختلفة للحل، ثم تتحقق من الاتساق المنطقي قبل تقديم البرهان النهائي. ومع ذلك، لم تنشر الشركتان في المواد المتاحة جميع التفاصيل التقنية اللازمة لمقارنة حجم النماذج أو الموارد الحاسوبية أو عدد المحاولات بصورة مستقلة.

لا تعني القدرة على حل مسائل الأولمبياد إتقان البحث الرياضي المفتوح الذي يظل أكثر تعقيداً وأقل قابلية للتقييم المباشر (أدوبي)

حدود الاختبار

رغم صعوبة مسائل الأولمبياد، فإن النجاح فيها لا يساوي بالضرورة القدرة على إجراء أبحاث رياضية مفتوحة. فمسائل المسابقة مصممة لتملك حلولاً محددة يمكن تقييمها خلال وقت محدود، بينما قد تتطلب مسائل البحث العلمي أسابيع أو أشهراً، وتفتقر أحياناً إلى مسار معروف أو إجابة جاهزة.

وأظهرت دراسة بحثية حديثة لاختبار نماذج متقدمة على 25 مسألة رياضية بحثية خاصة أن جميع النماذج التي خضعت للتقييم سجلت أقل من 10 في المائة، ما يشير إلى استمرار فجوة بين التفوق في مسابقات الرياضيات وحل المسائل البحثية الجديدة.

وتظل نتيجة «هواوي» و«شياوهونغشو» مؤشراً على تقدم الذكاء الاصطناعي في إنتاج البراهين الرياضية ضمن مسائل محددة ومقيدة. لكنها لا تكفي وحدها للحكم على قدرته على الابتكار الرياضي العام أو الاستغناء عن التحقق البشري، خصوصاً في المسائل التي لا تتوافر لها إجابات مرجعية واضحة.


مقالات ذات صلة

ماسك: الذكاء الاصطناعي سيتفوّق على نظيره البشري مجتمعاً خلال 5 سنوات

تكنولوجيا الملياردير الأميركي إيلون ماسك (د.ب.أ)

ماسك: الذكاء الاصطناعي سيتفوّق على نظيره البشري مجتمعاً خلال 5 سنوات

توقّع الملياردير إيلون ماسك أن يشهد العالم في السنوات القليلة المقبلة قفزة غير مسبوقة في قدرات الذكاء الاصطناعي، وعدّ أن هذه التقنية ستتجاوز ذكاء البشر مجتمعاً.

«الشرق الأوسط» (لندن)
تكنولوجيا يطلب النظام من المستخدم تسجيل فيديو للوجه وتنفيذ حركات محددة للتحقق من أن التسجيل مباشر وليس صورة ثابتة (أدوبي)

«غوغل» تختبر فيديو «سيلفي» لاستعادة الوصول إلى الحسابات

تضيف «غوغل» فيديو «سيلفي» لاستعادة الحساب عند فقدان الهاتف مع التحقق من الهوية والتشفير ومواجهة الانتحال والتزييف العميق بصورة آمنة.

نسيم رمضان (لندن)
خاص تجمع النماذج الهجينة بين المبادئ الهندسية وبيانات التشغيل لتقريب خطط مصافي النفط من الأداء الفعلي للوحدات (أدوبي)

خاص كيف يضيّق الذكاء الاصطناعي فجوة التخطيط والتشغيل في مصافي النفط؟

تساعد النماذج الهجينة مصافي النفط على تحسين دقة التخطيط وتقليص فجوة الأداء ودعم القرارات التشغيلية، مع إبقاء الرقابة البشرية المباشرة.

نسيم رمضان (لندن)
يوميات الشرق شعار شركة «أوبن إيه آي» يظهر على شاشة هاتف إلى جانب شعار برنامج «شات جي بي تي» (أ.ف.ب)

نصيحة من «شات جي بي تي» كادت تكلف رجلاً حياته... ودعوى ضد «أوبن إيه آي»

يثير التوسع المتسارع في استخدام أدوات الذكاء الاصطناعي في الحصول على المعلومات الصحية تساؤلات متزايدة حول حدود مسؤوليتها.

«الشرق الأوسط» (واشنطن)
خاص تشير «سناب» إلى أن النضج الإعلاني يعتمد على ترابط الاستراتيجية والإبداع والتنشيط والبيانات والقياس ضمن منظومة واحدة (شاترستوك)

خاص «سناب» لـ «الشرق الأوسط»: الإنفاق الرقمي في السعودية يدخل مرحلة التركيز على العائد

ينتقل الإعلان الرقمي السعودي نحو الفاعلية عبر ربط الاستراتيجية والإبداع والقياس بالنتائج، وتعزيز الملاءمة الثقافية، وتكامل القنوات، لتحقيق نمو مستدام.

نسيم رمضان (لندن)