تقنية مستوحاة من الدماغ لتحسين رؤية الذكاء الاصطناعي في الضباب

الدراسة قد تفيد القيادة الذاتية وأنظمة السلامة

الدراسة تختبر آلية مستوحاة من الدماغ لتحسين تعامل الذكاء الاصطناعي مع الصور الضبابية (شاترستوك)
الدراسة تختبر آلية مستوحاة من الدماغ لتحسين تعامل الذكاء الاصطناعي مع الصور الضبابية (شاترستوك)
TT

تقنية مستوحاة من الدماغ لتحسين رؤية الذكاء الاصطناعي في الضباب

الدراسة تختبر آلية مستوحاة من الدماغ لتحسين تعامل الذكاء الاصطناعي مع الصور الضبابية (شاترستوك)
الدراسة تختبر آلية مستوحاة من الدماغ لتحسين تعامل الذكاء الاصطناعي مع الصور الضبابية (شاترستوك)

تواجه أنظمة الرؤية الحاسوبية مشكلة أساسية عند الانتقال من بيئات التدريب النظيفة إلى ظروف العالم الحقيقي. فالصور التي تلتقطها الكاميرات في الشوارع لا تأتي دائماً بإضاءة مثالية أو تباين واضح أو طقس مستقر. في الضباب والمطر وضعف الإضاءة، قد تفقد نماذج الذكاء الاصطناعي جزءاً من قدرتها على تمييز السيارات والمشاة والطرق والعناصر المحيطة، حتى لو كانت قد حققت نتائج جيدة في الاختبارات التقليدية.

تطرح دراسة منشورة في دورية «Pattern Recognition Letters» كيفية جعل الشبكات العصبية المستخدمة في تقسيم الصور أكثر قدرة على التكيف مع تغيرات الصورة غير المهمة، مثل اختلاف التباين والإضاءة والضباب، من دون تغيير المهمة الأساسية التي يفترض أن تؤديها. وتختبر الدراسة إدخال آلية تُعرَف باسم «التطبيع القسمي» (Divisive Normalization) داخل بنية من نوع «U-Net»، وهي من البنى الشائعة في مهام تقسيم الصور.

التقنية تساعد النموذج على التركيز على بنية المشهد بدلاً من التغيرات السطحية في الإضاءة والتباين (شاترستوك)

صلابة النماذج البصرية

تقسيم الصور يعني أن يحدد النموذج ما الذي يظهر في كل جزء من الصورة. في مشهد شارع مثلاً، يجب أن يميز النظام بين الطريق والسيارات والمباني والأرصفة والمشاة. هذه المهمة أساسية في تطبيقات مثل القيادة الذاتية وتحليل المشاهد الحضرية وأنظمة المراقبة والروبوتات. لكن صعوبتها تزيد عندما تتغير ظروف التصوير. فالضباب لا يغير وجود السيارة في الصورة، لكنه يغير وضوحها وحدودها وتباينها مع الخلفية.

تنطلق الدراسة من فكرة أن كثيراً من نماذج التعلم الآلي تكون «صلبة» أكثر من اللازم في التعامل مع تغيرات المدخلات. فهي تتعلم من صور معينة ضمن ظروف محددة، ثم تتراجع دقتها عندما تواجه صوراً مشابهة في المحتوى، لكنها مختلفة في الشكل أو الظروف. ولهذا؛ ركز الباحثون على آلية مستوحاة من علم الأعصاب الحسي، حيث يستخدم الدماغ أشكالاً من التكيف لمعالجة التغيرات في الإضاءة والتباين، بدلاً من التعامل مع كل تغير بسيط كما لو كان معلومة جديدة ومهمة.

السياق يضبط الصورة

تعمل آلية «Divisive Normalization» على تعديل استجابة الخلايا أو الوحدات داخل الشبكة العصبية عبر مقارنتها بسياقها المحلي. بمعنى مبسط، لا ينظر النموذج إلى قيمة بكسل أو ميزة ما بمعزل عن محيطها، بل يعيد ضبط الاستجابة بناءً على البيئة القريبة داخل الصورة. هذا يساعد على تقليل تأثير التغيرات المحلية في التباين أو الإضاءة، ويجعل السمات التي يتعلمها النموذج أكثر ثباتاً عندما تتغير ظروف التصوير.

اختبر الباحثون هذه الفكرة على بنية «U-Net» في مهمة تقسيم الصور، وقارنوا أداء النسخة المعدلة مع النسخة التقليدية من الشبكة. واستخدموا في التدريب والتقييم مجموعة «سيتي سكايبس» (Cityscapes)، وهي مجموعة بيانات معروفة لمشاهد حضرية، كما استخدموا «فوغي سيتي سكايبس» (Foggy Cityscapes) لاختبار الأداء في ظروف ضبابية. وتشير النتائج إلى أن إدخال التطبيع القسمي أدى إلى تحسين نتائج التقسيم مقارنة ببنية «U-Net» التقليدية.

النتائج قد تفيد تطبيقات مثل القيادة الذاتية وأنظمة مساعدة السائق والمراقبة الذكية (غيتي)

اختبار الظروف الصعبة

أهمية النتيجة لا تكمن فقط في وجود تحسن، بل في مكان ظهوره بوضوح أكبر. وحسب ملخص الدراسة، تراوح التحسن في معيار «IoU» من نحو 3 في المائة في ظروف الطقس العادية، ووصل إلى نحو 20 في المائة في حالات الضباب الكثيف. ويعني ذلك أن الفائدة تصبح أكبر عندما تتدهور ظروف الصورة، أي في الحالات التي تحتاج فيها أنظمة الرؤية الحاسوبية إلى قدر أعلى من الاعتمادية.

هذا لا يعني أن التقنية تحل كل مشكلات الرؤية الحاسوبية في الظروف الصعبة. فالضباب الكثيف أو ضعف الرؤية الشديد قد يبقى تحدياً كبيراً لأي نظام يعتمد على الصور. كما أن الدراسة ركزت على بنى محددة ومجموعات بيانات معينة، ولا تكفي وحدها لإثبات أن التحسن نفسه سيتكرر في كل أنواع الكاميرات أو المدن أو الظروف الجوية. لكنها تقدم مؤشراً مهماً إلى أن تحسين طريقة معالجة الشبكة للسمات البصرية قد يكون فعالاً، خصوصاً عندما تكون المشكلة في تغيرات غير جوهرية داخل الصورة، لا في اختلاف المشهد نفسه.

التحسن كان أوضح في ظروف الضباب الكثيف... حيث تحتاج الأنظمة إلى اعتمادية أعلى (غيتي)

ثبات للرؤية الآلية

توضح الدراسة أيضاً أن فوائد «التطبيع القسمي» يمكن فهمها من خلال تحليل استجابات الشبكة. فالآلية تحدِث نوعاً من الموازنة داخل التمثيلات البصرية؛ ما يجعل الميزات الناتجة أقل حساسية للتغيرات المحلية في التباين والإضاءة. بعبارة أخرى، يصبح النموذج أكثر تركيزاً على البنية المهمة للمشهد، وأقل انشغالاً بتغيرات سطحية قد تربكه في الظروف التقليدية.

تكتسب هذه النتائج أهمية خاصة في تطبيقات السلامة. فالأنظمة التي تعمل في الشوارع أو المصانع أو البنية التحتية لا تواجه دائماً صوراً مثالية. في القيادة الذاتية ومساعدة السائق، قد يظهر الخطر في لحظة ضباب أو وهج أو إضاءة متغيرة. وفي المراقبة الصناعية أو الحضرية، قد تؤثر الظروف البيئية في قدرة النموذج على فهم المشهد. لذلك؛ فإن أي تحسين يجعل الشبكات العصبية أكثر ثباتاً أمام هذه التغيرات يمكن أن يكون مهماً عند تطوير أنظمة أكثر اعتماداً في العالم الحقيقي.

كما تبرز الدراسة اتجاهاً أوسع في أبحاث الذكاء الاصطناعي، يتمثل في العودة إلى بعض مبادئ الإدراك البشري لتحسين النماذج الاصطناعية. فبدلاً من الاعتماد فقط على زيادة حجم النماذج أو البيانات، تبحث هذه المقاربة في كيفية جعل النموذج أكثر قدرة على التكيف مع تغيرات البيئة. وفي هذا الإطار، لا يكون التطبيع القسمي مجرد إضافة تقنية صغيرة، بل يكون مثالاً على أن بعض العمليات المعروفة في علم الأعصاب قد تساعد في معالجة ضعف عملي في نماذج الرؤية الحاسوبية.


مقالات ذات صلة

«نتفليكس» استخدمت الذكاء الاصطناعي في 300 عمل هذا العام

يوميات الشرق شعار «نتفليكس» (أ.ف.ب)

«نتفليكس» استخدمت الذكاء الاصطناعي في 300 عمل هذا العام

أعلنت شركة «نتفليكس»، الأميركية العملاقة لخدمات البثِّ الرقمي المباشر استخدام الذكاء الاصطناعي في نحو 300 عمل فني خلال العام الحالي فقط.

«الشرق الأوسط» (نيويورك)
تكنولوجيا شعار تطبيق «أوبن إيه آي» (رويترز)

بعد فقدان «أوبن إيه آي» السيطرة على أحد نماذجها... مشرعون يطالبون بـ«مفتاح إيقاف»

أعاد إعلان شركة «أوبن إيه آي» فقدان السيطرة على أحد نماذجها التجريبية خلال الاختبارات إشعال الجدل داخل الولايات المتحدة بشأن المخاطر المحتملة للذكاء الاصطناعي.

«الشرق الأوسط» (واشنطن)
تكنولوجيا الملياردير الأميركي إيلون ماسك (د.ب.أ)

ماسك: الذكاء الاصطناعي سيتفوّق على نظيره البشري مجتمعاً خلال 5 سنوات

توقّع الملياردير إيلون ماسك أن يشهد العالم في السنوات القليلة المقبلة قفزة غير مسبوقة في قدرات الذكاء الاصطناعي، وعدّ أن هذه التقنية ستتجاوز ذكاء البشر مجتمعاً.

«الشرق الأوسط» (لندن)
تكنولوجيا خضع النموذجان لتقييم منفصل بعد انتهاء مسابقة الطلاب ولم يشاركا ضمن الترتيب الرسمي للأولمبياد (أدوبي)

نموذجا ذكاء اصطناعي صينيان يحلّان مسائل أولمبياد الرياضيات بلا خطأ

حقق نموذجان صينيان للذكاء الاصطناعي العلامة الكاملة في مسائل أولمبياد الرياضيات، ضمن تقييم منفصل عن منافسات الطلاب الرسمية هذا العام.

نسيم رمضان (لندن)
تكنولوجيا يطلب النظام من المستخدم تسجيل فيديو للوجه وتنفيذ حركات محددة للتحقق من أن التسجيل مباشر وليس صورة ثابتة (أدوبي)

«غوغل» تختبر فيديو «سيلفي» لاستعادة الوصول إلى الحسابات

تضيف «غوغل» فيديو «سيلفي» لاستعادة الحساب عند فقدان الهاتف مع التحقق من الهوية والتشفير ومواجهة الانتحال والتزييف العميق بصورة آمنة.

نسيم رمضان (لندن)