في جزء من الثانية... «هارت» يولد صوراً عالية الجودة عبر الذكاء الاصطناعي

بسرعة أكبر بتسع مرات من النماذج الحالية!

مزج الباحثون بين نماذج الذكاء الاصطناعي التوليدية لإنشاء أداة سريعة تنتج صوراً بدقة عالية (Christine Daniloff, MIT)
مزج الباحثون بين نماذج الذكاء الاصطناعي التوليدية لإنشاء أداة سريعة تنتج صوراً بدقة عالية (Christine Daniloff, MIT)
TT
20

في جزء من الثانية... «هارت» يولد صوراً عالية الجودة عبر الذكاء الاصطناعي

مزج الباحثون بين نماذج الذكاء الاصطناعي التوليدية لإنشاء أداة سريعة تنتج صوراً بدقة عالية (Christine Daniloff, MIT)
مزج الباحثون بين نماذج الذكاء الاصطناعي التوليدية لإنشاء أداة سريعة تنتج صوراً بدقة عالية (Christine Daniloff, MIT)

يُعدُّ توليد صور عالية الجودة بكفاءة تحدياً بالغ الأهمية، خصوصاً للتطبيقات، مثل تدريب السيارات ذاتية القيادة، أو تصميم بيئات ألعاب الفيديو، أو محاكاة سيناريوهات العالم الحقيقي. وفي حين حققت نماذج الذكاء الاصطناعي تقدماً كبيراً في توليد الصور، لا تزال الطرق الحالية تواجه مفاضلة بين السرعة والجودة.

نماذج الانتشار (Diffusion Models)، مثل تلك المستخدمة في «DALL-E» و«Stable Diffusion»، تنتج صوراً واقعية مذهلة، لكنها تتطلب قوة حاسوبية كبيرة ووقتاً طويلاً. من ناحية أخرى، النماذج الانحدارية الذاتية (Autoregressive Models) المشابهة لتلك المستخدمة في نماذج اللغة الكبيرة مثل «تشات جي بي تي» (ChatGPT) تولد الصور بسرعة، لكنها غالباً ما تعاني مع التفاصيل الدقيقة، ما يؤدي إلى نتائج مشوهة أو ضبابية. الآن، طور فريق من الباحثين من معهد «ماساتشوستس للتكنولوجيا» (MIT) وشركة «إنفيديا» (NVIDIA) حلّاً مبتكراً يُدعى «هارت» (HART) وهو نموذج ذكاء اصطناعي جديد يجمع بين مزايا الطريقتين لتقديم صور عالية الجودة بسرعات غير مسبوقة.

أفضل ما في الطريقتين

يعمل «HART» على مبدأ بسيط لكنه قوي. أولاً، يقوم النموذج برسم الخطوط العريضة للصورة بسرعة، ثم يقوم نموذج انتشار صغير بتنقيح التفاصيل، فماذا يعني ذلك؟

يوضح هاوتيان تانغ، طالب الدكتوراه في «MIT»، والمؤلف الرئيسي المشارك للبحث، الأمر بهذه العبارة: «تخيَّل الأمر مثل الرسم». ويتابع: «إذا غطّيت اللوحة كلها دفعة واحدة، فقد تبدو النتيجة خاماً. لكن إذا بدأت برسم عام، ثم نقحته بضربات فرشاة أصغر وأدق، تصبح الصورة النهائية أكثر إتقاناً».

تعمل نماذج الانتشار التقليدية عن طريق إزالة الضوضاء من الصورة خطوة بخطوة حتى تظهر صورة واضحة. وهذه العملية تضمن دقة عالية لكنها بطيئة وتستهلك موارد كبيرة. في المقابل، تولد نماذج «هارت» (HART) الصور بشكل تسلسلي، متنبئة بأجزاء صغيرة في كل مرة. وفي حين تكون أسرع، فإنها غالباً ما تفقد تفاصيل مهمة بسبب الضغط.

يملأ «HART» هذه الفجوة باستخدام نموذج انحدار ذاتي للتعامل مع الجزء الأكبر من توليد الصورة، ثم تطبيق نموذج انتشار خفيف فقط لتحسين التفاصيل المتبقية، أي تلك العناصر الدقيقة التي تجعل الصورة حية مثل ملمس الشعر، وبريق العين، أو الحواف الدقيقة للأجسام.

يتميز نموذج «HART» الجديد بقدرته على إنتاج صور بجودة تعادل أو تفوق أحدث نماذج الانتشار لكن بسرعة أعلى بتسع مرات (MIT)
يتميز نموذج «HART» الجديد بقدرته على إنتاج صور بجودة تعادل أو تفوق أحدث نماذج الانتشار لكن بسرعة أعلى بتسع مرات (MIT)

السرعة دون التضحية بالجودة

من أكثر إنجازات «HART» إثارة للإعجاب هي كفاءته. وفي حين تتطلب نماذج الانتشار الحديثة مليارات المعلمات وعشرات الخطوات للتنقيح، يُحقق «هارت» نتائج مماثلة أو حتى أفضل بجزء بسيط من التكلفة الحاسوبية.

في الاختبارات، أنتج «HART» صوراً أسرع بتسع مرات من نماذج الانتشار الرائدة، مع الحفاظ على مستوى التفاصيل نفسه. والأكثر إثارة، أنه يفعل ذلك باستخدام طاقة حاسوبية أقل بنسبة 31 في المائة، ما يجعله قابلاً للتشغيل على أجهزة المستهلك العادية، مثل أجهزة اللابتوب أو الهواتف الذكية.

يقول تانغ: «نموذج الانتشار في (HART) لديه مهمة أبسط بكثير... فهو يحتاج فقط لتصحيح التفاصيل الدقيقة، وليس الصورة بأكملها، ما يجعل العملية أكثر كفاءة».

فتح آفاق جديدة

تمتد آثار «HART» إلى ما هو أبعد من مجرد توليد صور أسرع. تصميمه الهجين يجعله شديد التكيف للدمج مع أنظمة الذكاء الاصطناعي متعددة الوسائط، مثل نماذج الرؤية واللغة التي يُمكنها تفسير وتوليد النصوص والصور معاً.

تخيَّل أن تطلب من مساعد ذكي أن يرشدك خلال تجميع قطعة أثاث، مع عرض مرئي لكل خطوة في الوقت الفعلي، أو فكِّر في سيارات ذاتية القيادة يتم تدريبها في بيئات افتراضية فائقة الواقعية، تتعلم تجنب المخاطر غير المتوقعة، قبل أن تصل حتى إلى الطريق. سرعة ودقة «HART» مكَّنَتا من جعل هذه التطبيقات ليست ممكنة فحسب، بل عملية أيضاً.

في المستقبل، يُخطط الباحثون لتوسيع قدرات «HART»، لتشمل توليد الفيديو وتركيب الصوت، مستفيدين من تصميمه القابل للتوسع لمهام أكثر تعقيداً.

خطوة نحو ذكاء اصطناعي أذكى

يُمثل «HART» قفزة كبيرة إلى الأمام في مجال الذكاء الاصطناعي التوليدي، مبرهناً على أن السرعة والجودة يجب ألا يكونا متناقضين. من خلال الجمع الذكي بين نقاط قوة النماذج الانحدارية الذاتية ونماذج الانتشار، يفتح الباحثون أبواباً جديدة لتوليد الصور عالية الدقة في الوقت الفعلي، ما يقربنا من مستقبل يمكن فيه للذكاء الاصطناعي أن يدمج الإبداع والكفاءة بسلاسة.

هذا البحث، المدعوم من مختبر «MIT-IBM Watson» للذكاء الاصطناعي، ومركز «MIT» و«Amazon للعلوم»، ومؤسسة «العلوم الوطنية الأميركية»، سيُعرض في المؤتمر الدولي حول التمثيلات التعليمية. ومع مزيد من التطوير، قد يصبح «HART» قريباً حجر الزاوية في تطبيقات الذكاء الاصطناعي من الجيل التالي، ما يُعيد تشكيل طريقة تفاعلنا مع الذكاء الاصطناعي والاستفادة منه.


مقالات ذات صلة

تفاعل «سوشيالي» مع صور من عالم «استوديو غيبلي»... ومخاوف بشأن حقوق الملكية

يوميات الشرق صور مولدة بالذكاء الاصطناعي لإحدى لقطات فيلم «سمير وشهير وبهير» على غرار استديو غيبيلي (متداولة)

تفاعل «سوشيالي» مع صور من عالم «استوديو غيبلي»... ومخاوف بشأن حقوق الملكية

انتشرت في الأيام السابقة صور مُنتجة بالذكاء الاصطناعي على غرار  «استوديو غيبلي»، استوديو الرسوم المتحركة الياباني الشهير.

يسرا سلامة (القاهرة)
تحليل إخباري يُعيد الذكاء الاصطناعي تشكيل الذكاء البشري بتوسيع قدراته وتعزيز تفاعله مع الحواسيب (شاترستوك)

تحليل إخباري مستقبل العلاقة بين ذكاء الإنسان والحاسوب... تعايش أم صراع؟

يُحدث الذكاء الاصطناعي ثورة في قدرات الذكاء البشري، ما يُمكِّن من الاندماج الكامل مع الحواسيب لتعزيز القدرات الذهنية والتكنولوجية بشكل غير مسبوق.

د. حسن الشريف
خاص يعزز الذكاء الاصطناعي من كفاءة العمليات ويوفر تجارب تسوق شخصية من خلال تحسين الاتصال وتوفير تحليلات فورية (أ.ف.ب)

خاص كيف يساعد الذكاء الاصطناعي تجار التجزئة في تحليل سلوك المستهلك بدقة؟

تلعب الشبكات المدعومة بالذكاء الاصطناعي دوراً أساسياً في تخصيص تجربة التسوق فورياً مستفيدةً من بيانات تفاعلات العملاء وسجلات التصفح والرؤى القائمة على الموقع.

نسيم رمضان (لندن)
يوميات الشرق المؤسس المشارك والمدير التنفيذي لشركة «سناب شات» إيفان شبيغل (رويترز)

لماذا يعطي رئيس «سناب شات» موظفيه مهمة صعبة في أول يوم عمل؟

يمنح المؤسس المشارك لشركة «سناب شات» إيفان شبيغل الموظفين الجدد في فريق التصميم الخاص به مهمة صعبة للغاية في يومهم الأول.

«الشرق الأوسط» (بكين)
تكنولوجيا تطبيق «سيغنال» يظهر على شاشة جوال ذكي (أ.ب) play-circle

بعد «فضيحة سيغنال»... ما تطبيق المراسلة الأكثر أماناً؟

في حين أن الخلل الأمني ​​دفع الرئيس الأميركي إلى التدقيق فيما إذا كان تطبيق «سيغنال» تتخلله أي عيوب، فإن المنصة، في الواقع، هي واحدة من الأكثر أماناً.

«الشرق الأوسط» (واشنطن)

ماسك يعلن استحواذ شركته للذكاء الاصطناعي على منصة «إكس»

إيلون ماسك وشعار منصة «إكس» (رويترز)
إيلون ماسك وشعار منصة «إكس» (رويترز)
TT
20

ماسك يعلن استحواذ شركته للذكاء الاصطناعي على منصة «إكس»

إيلون ماسك وشعار منصة «إكس» (رويترز)
إيلون ماسك وشعار منصة «إكس» (رويترز)

أعلن إيلون ماسك، الجمعة، استحواذ شركته الناشئة للذكاء الاصطناعي «إكس إيه آي» على منصة التواصل الاجتماعي «إكس» في صفقة تقدّر قيمة الشركة المعروفة سابقاً باسم «تويتر» بنحو 33 مليار دولار.

وقال ماسك في منشور على «إكس» إن الاستحواذ «من شأنه أن يفتح إمكانات هائلة من خلال الجمع بين قدرات الذكاء الاصطناعي المتقدمة وخبرة إكس إيه آي مع الانتشار الهائل لإكس».

وأضاف: «مستقبل شركتي إكس إيه.آي وإكس مترابط. اليوم، نتخذ رسميا خطوة دمج البيانات والنماذج والحوسبة والتوزيع والمهارات»، مضيفاً أن قيمة الشركة المدمجة ستبلغ 80 مليار دولار.