«GPT-Live» نموذج صوتي جديد من «أوبن إيه آي» يستمع ويتحدث في الوقت نفسه

يحوّل الصوت إلى واجهة أكثر تقدماً للذكاء الاصطناعي

يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)
يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)
TT

«GPT-Live» نموذج صوتي جديد من «أوبن إيه آي» يستمع ويتحدث في الوقت نفسه

يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)
يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)

أطلقت «أوبن إيه آي» جيلاً جديداً من نماذج الصوت باسم «جي بي تي لايف» (GPT-Live) في خطوة تهدف إلى جعل التحدث مع «تشات جي بي تي» أقرب إلى محادثة بشرية طبيعية، لا تبادل أوامر متقطعة بين المستخدم والنظام. ويبدأ طرح النموذج عالمياً داخل تجربة «ChatGPT Voice» عبر نسختين هما «GPT-Live-1» و«GPT-Live-1 mini» على أن يصل لاحقاً إلى واجهة البرمجة للمطورين والشركات.

الاستماع والتحدث معاً

الفرق الأساسي في النموذج الجديد أنه يعتمد على بنية تعرف باسم «full-duplex» أي أنه يستطيع الاستماع والتحدث في الوقت نفسه. في النماذج الصوتية السابقة، كان النظام ينتظر غالباً انتهاء المستخدم من الكلام قبل أن يبدأ في الرد، مما يجعل الحوار أقرب إلى جولات منفصلة. أما في النموذج الجديد، فيستطيع النظام متابعة الكلام، أو الصمت عندما يحتاج المستخدم إلى التفكير، أو الرد السريع، أو استخدام عبارات قصيرة تدل على أنه يتابع الحديث.

تقول «أوبن إيه آي» إن «GPT-Live» يستطيع اتخاذ قرارات تفاعلية مرات عدة في الثانية، مثل أن يتكلم أو يواصل الاستماع أو يتوقف أو يقاطع أو يستدعي أداة أخرى. هذا التحول مهم لأن كثيراً من الإحباط في تجارب الصوت السابقة كان ناتجاً عن سوء تقدير لحظة انتهاء الكلام، خصوصاً عند وجود توقف قصير أو ضوضاء في الخلفية.

يمكن للنموذج الاستعانة بنماذج أقوى في الخلفية عند الحاجة إلى تحليل أعمق أو تنفيذ مهام أكثر تعقيداً (رويترز)

تفاعل مستمر

توضح الشركة أن أجيالاً سابقة من أنظمة الصوت اعتمدت على سلسلة من النماذج المتتابعة أي نموذج يحول الكلام إلى نص، ثم نموذج لغوي ينتج الإجابة، ثم نموذج آخر يحول النص إلى صوت. هذه الطريقة فتحت الباب أمام المحادثة الصوتية مع نماذج متقدمة، لكنها كانت بطيئة نسبياً، وقد تفقد بعض المعلومات أثناء انتقالها بين النماذج.

أما «Advanced Voice Mode» فاختصر بعض هذه الخطوات عبر معالجة الصوت وإنتاجه داخل نموذج واحد، لكنه ظل قائماً على مبدأ الأدوار المنفصلة بين المستخدم والنظام. لذلك لم يكن الحوار دائماً بالمرونة نفسها التي تحدث في المحادثات البشرية، حيث يمكن للشخصين المقاطعة والتوضيح والتوقف والمتابعة بصورة طبيعية.

يحاول «GPT-Live» تجاوز هذا القيد عبر معالجة مستمرة للمدخلات الصوتية أثناء توليد الرد، مما يسمح بتدفق أكثر مرونة. وتقول الشركة إن ذلك يدعم أيضاً استخدامات مثل الترجمة المباشرة، لأن النظام لا يحتاج إلى انتظار انتهاء مقطع طويل قبل أن يبدأ في التعامل معه.

عقل أعمق في الخلفية

لا يقتصر التغيير على أسلوب الحوار حيث إن النموذج الجديد يفصل بين طبقة التفاعل الصوتي السريع والمهام التي تحتاج إلى تفكير أعمق أو بحث أو تنفيذ خطوات أكثر تعقيداً. عند الحاجة، يمكن لـ«GPT-Live» أن يحيل المهمة إلى نموذج أكثر تقدماً في الخلفية، مثل «GPT-5.5» عند الإطلاق، ثم يعيد النتيجة إلى المحادثة عندما تصبح جاهزة.

هذا التصميم يعالج مشكلة عملية في واجهات الصوت. فالمستخدم لا يريد أن تتحول كل مهمة صعبة إلى صمت طويل، ولا يريد في الوقت نفسه إجابة سطحية لمجرد الحفاظ على سرعة الحوار. لذلك يحاول النظام الجمع بين الاستجابة الصوتية السريعة والقدرة على الاستعانة بنموذج أقوى للبحث أو التحليل أو تنفيذ مهام أكثر تعقيداً.

وتشير «أوبن إيه آي» إلى أن هذا النهج قد يفتح لاحقاً المجال أمام استخدام الصوت في أعمال أطول وأكثر تعقيداً وذات طابع وكيل، حيث لا يكتفي النموذج بالرد، بل يساعد في إنجاز مهام متعددة أثناء استمرار المحادثة.

يهدف «GPT-Live» إلى تحسين سلاسة الحوار الصوتي خصوصاً عند المقاطعة أو التوقف أو وجود ضوضاء في الخلفية (رويترز)

تجربة جديدة داخل «تشات جي بي تي»

مع الطرح الجديد، يصبح «GPT-Live» المحرك الافتراضي لتجربة الصوت في «تشات جي بي تي». وستحصل خطط «Go» و«Plus» و«Pro» على: «GPT-Live-1» بينما تعتمد الخطة المجانية على «GPT-Live-1 mini». وتقول الشركة إن أكثر من 150 مليون شخص يستخدمون أسبوعياً ميزات مثل الصوت والإملاء داخل «تشات جي بي تي»، سواء للمساعدة اليومية من دون استخدام اليدين، أو ممارسة اللغات، أو المحادثة أثناء التنقل.

وتتضمن التجربة الجديدة قدرة أفضل على الاستماع في ظروف أقل مثالية، مثل وجود ضوضاء في الطريق أو محادثات قريبة، إضافة إلى إمكانية أن يطلب المستخدم من النظام أن ينتظر أو يصمت أو يبطئ إيقاعه. كما أعادت الشركة تحسين الأصوات التسعة المتاحة في «تشات جي بي تي» لتناسب النموذج الجديد.

وتضيف «أوبن إيه آي» أن الصوت سيستمر في دعم البحث والذاكرة والصور ورفع الملفات، مع إمكانية عرض بطاقات مرئية لبعض الإجابات، مثل الطقس أو الأسهم أو الرياضة، أثناء استمرار المحادثة الصوتية.

السلامة في محادثة فورية

لأن الصوت أكثر قرباً وحساسية من النص، خصصت الشركة جانباً من الإعلان لإجراءات السلامة. فقد وسّعت اختبارات النموذج لتشمل تقييمات صوتية مرتبطة بمخاطر مثل إيذاء النفس، والاعتماد العاطفي على الذكاء الاصطناعي، والعنف، والمحتوى الجنسي. كما تقول إن النظام يملك آليات يمكن أن تتدخل أثناء الكلام إذا رصدت مخرجات غير آمنة، إما بتوجيه الرد نحو مسار أكثر أماناً، أو عرض موارد دعم، أو إنهاء المحادثة في الحالات الأعلى خطراً.

وتقول الشركة أيضاً إن «GPT-Live» مصمم للمحادثة لا لتقليد أصوات أشخاص حقيقيين، ويستخدم مجموعة محددة مسبقاً من الأصوات داخل «تشات جي بي تي»، مع ضوابط تمنع انتحال الأصوات.

حدود الإطلاق

رغم الطرح الواسع، لا تزال هناك حدود واضحة. فالنموذج لا يدعم عند الإطلاق استخدام الصوت مع الفيديو أو مشاركة الشاشة داخل «تشات جي بي تي»، مع أن الشركة تقول إنها تعمل على إضافة هذه القدرات لاحقاً. كما تشير إلى أن النموذج محسن لبعض اللغات الأكثر استخداماً في «تشات جي بي تي»، وأن بعض اللغات قد تظهر فيها لكنة غير أصلية أو فجوات في الطلاقة.

يمثل «GPT-Live» محاولة لنقل الذكاء الاصطناعي الصوتي من مرحلة الأوامر المتبادلة إلى واجهة أكثر استمرارية، تستطيع الاستماع والتحدث والانتظار والاستعانة بنماذج أقوى في الخلفية. وإذا نجح هذا الاتجاه، فقد يصبح الصوت واجهة رئيسية للتعامل مع الذكاء الاصطناعي، ليس فقط للسؤال والجواب، بل للتعاون على مهام يومية أطول وأكثر تعقيداً.


مقالات ذات صلة

«أوبن. إيه. آي» تعيد النظر في قواعد السلامة بعد تمرد نماذج للذكاء الاصطناعي

الاقتصاد قرصنة برنامج للذكاء الاصطناعي جاءت بمبادرة منه تماماً ولم تكتشف «أوبن. إيه. آي» الهجوم إلا بعد وقوعه (رويترز)

«أوبن. إيه. آي» تعيد النظر في قواعد السلامة بعد تمرد نماذج للذكاء الاصطناعي

بدأت شركة تطبيقات الذكاء الاصطناعي الأميركية «أوبن. إيه.آي» تشديد إجراءات السلامة في اختبارات الذكاء الاصطناعي بعد قيام برنامج بعملية قرصنة رفيعة المستوى.

«الشرق الأوسط» (نيويورك)
تكنولوجيا شعار شركة «أبل» يظهر ضمن رسم توضيحي (رويترز)

«أبل» تتهم موظفاً سابقاً بتصوير وثائق سرية قبل انتقاله إلى «أوبن إيه آي»

صعّدت شركة «أبل» نزاعها القانوني مع «أوبن إيه آي» متهمةً أحد موظفي الأخيرة وهو موظف سابق لديها بتصوير وثائق سرية تتعلق بخطط تطوير منتجات لم يُكشف عنها

«الشرق الأوسط» (واشنطن)
تكنولوجيا ما الذي تعرفه روبوتات الدردشة عنك... وعن حياتك؟

ما الذي تعرفه روبوتات الدردشة عنك... وعن حياتك؟

الطبيعة الشاملة لأنواع المعلومات والملفات التي تجمعها أمر استثنائي لم يسبق له مثيل

بريان إكس تشين (نيويورك)
تكنولوجيا شعار تطبيق «أوبن إيه آي» (رويترز)

بعد فقدان «أوبن إيه آي» السيطرة على أحد نماذجها... مشرعون يطالبون بـ«مفتاح إيقاف»

أعاد إعلان شركة «أوبن إيه آي» فقدان السيطرة على أحد نماذجها التجريبية خلال الاختبارات إشعال الجدل داخل الولايات المتحدة بشأن المخاطر المحتملة للذكاء الاصطناعي.

«الشرق الأوسط» (واشنطن)
يوميات الشرق شعار شركة «أوبن إيه آي» يظهر على شاشة هاتف إلى جانب شعار برنامج «شات جي بي تي» (أ.ف.ب)

نصيحة من «شات جي بي تي» كادت تكلف رجلاً حياته... ودعوى ضد «أوبن إيه آي»

يثير التوسع المتسارع في استخدام أدوات الذكاء الاصطناعي في الحصول على المعلومات الصحية تساؤلات متزايدة حول حدود مسؤوليتها.

«الشرق الأوسط» (واشنطن)

علماء يكتشفون أسرع نجم في مجرّة درب التبانة

مجرّة درب التبانة (د.ب.أ)
مجرّة درب التبانة (د.ب.أ)
TT

علماء يكتشفون أسرع نجم في مجرّة درب التبانة

مجرّة درب التبانة (د.ب.أ)
مجرّة درب التبانة (د.ب.أ)

اكتشف فريق من علماء الفلك أسرع نجم في مجرّة درب التبانة، إذ يدور بسرعة كبيرة جداً تبلغ 25 ألف كيلومتر في الثانية حول الثقب الأسود فائق الكتلة في مركز هذه المجرّة التي تضمّ كوكب الأرض.

ويأمل العلماء المسؤولون عن هذا الاكتشاف، الذي نُشرت نتائجه في مجلة «نيتشر»، في أن يتيح النجم الجديد «إس 301» خلال عشر سنوات تحديد سرعة دوران الثقب الأسود مباشرة واختبار نظرية أينشتاين.

وقال مدير معهد ماكس بلانك لفيزياء خارج الأرض في مدينة غارشينغ الألمانية، العضو المؤسس للفريق المسؤول عن هذا الإنجاز العلمي الجديد، رينهارد غينزل، إن «رصداً دقيقاً، على مدى عقود، للنجوم التي تدور حول الثقب الأسود المركزي في مجرّة درب التبّانة وهو القوس أ* أتاح هذا الاكتشاف الكبير لنجم واعد جداً».

وأضاف غينزل الفائز بالمشاركة في جائزة نوبل للفيزياء عام 2020 عن اكتشاف الثقب الأسود المركزي في درب التبانة أن «+إس 301+ يفتح بفضل قربه الشديد من القوس أ* نافذة جديدة على الخصائص الأساسية للزمكان» في الثقب الأسود، على ما جاء في بيان المرصد الأوروبي الجنوبي.

واستخدم العلماء لاكتشاف «إس 301» جهاز التداخل التابع لمقراب «فيري لارج تلسكوب» التابع للمرصد الأوروبي الجنوبي في تشيلي، وأداته «غرافيتي +».

وشرح طالب الدكتوراه في معهد ماكس بلانك فيليكس مانغ المشارك في تأليف الدراسة أن «ما يميّز هذا النجم هو كونه يدور حول القوس أ* في مسار قريب جداً منه، فدورته الكاملة حوله لا تستغرق سوى 8,7 سنة، ويدنو من الثقب الأسود حتى مسافة لا تتجاوز 12 مرة المسافة بين الأرض والشمس».

وعند النقطة التي يكون فيها الأقرب إلى الثقب الأسود، يتحرّك «إس 301» بسرعة تقارب 25 ألف كيلومتر في الثانية، أي أسرع بنحو مائة ألف مرة من طائرة ركّاب، وبنسبة 8 في المائة من سرعة الضوء، ما يجعله أسرع نجم معروف حتى الآن في مجرّة درب التبانة.


منافسة شرسة في سوق الأجهزة القابلة للارتداء

الساعات الذكية توظف لتتبع مؤشرات اللياقة البدنية والمؤشرات الصحية
الساعات الذكية توظف لتتبع مؤشرات اللياقة البدنية والمؤشرات الصحية
TT

منافسة شرسة في سوق الأجهزة القابلة للارتداء

الساعات الذكية توظف لتتبع مؤشرات اللياقة البدنية والمؤشرات الصحية
الساعات الذكية توظف لتتبع مؤشرات اللياقة البدنية والمؤشرات الصحية

نحن الآن في عام 2035... وأنت - شأنك شأن معظم من تعرفهم - تحمل جهازاً صغيراً بحجم الزر مزروعاً في ساعدك. ومقابل أجور دورية، يقوم هذا الجهاز بمراقبة مستمرة لضغط الدم، ودرجة حرارة الجسم الداخلية، ونشاط القلب والأوعية الدموية، وجميع المؤشرات الصحية الأخرى التي تهم الطبيب. وفي حال رصد أي أمر مثير للريبة، يقوم نظام ذكاء اصطناعي مخصص بتنبيه طبيبك على الفور؛ ما يتيح اكتشاف الأمراض والعلل - وعلاجها - في أقرب وقت ممكن، كما كتب برنت كرين(*).

«تعظيم الصحة»

هذا هو مستقبل «تعظيم الصحة (healthmaxxing)»، المصطلح الذي تقدمه صناعة الأجهزة القابلة للارتداء العالمية - التي تبلغ قيمتها 44 مليار دولار - وتهدف إلى تحقيقه بسرعة؛ حيث تقدم مجموعة واسعة من الساعات والخواتم والأساور الذكية أساليب جديدة لتتبع البيانات الصحية وبيانات اللياقة البدنية.

منذ إطلاق جهاز «فيتبيت تراكر (Fitbit Tracker)» الرائد في عام 2009. كان اهتمام المستهلكين هو المحرك الأساسي لهذا القطاع. ولكن ما جذب انتباه بعض أكبر الشركات في العالم - بما في ذلك «أبل» و«سامسونغ» و«غوغل» - هو رؤية قد تكون أكثر ربحية بكثير.

ويقول جيتيش أوبراني، محلل الصناعة في شركة أبحاث التكنولوجيا «آي دي سي»: «الهدف النهائي هو أن تصبح هذه الأجهزة جزءاً من المنظومة الطبية. إنها سوق مربحة للغاية إذا ما أوصت المستشفيات والأطباء باستخدام أحد هذه الأجهزة».

منافسة شرسة

وتفسر هذه الرؤية بعيدة المدى - جزئياً - سبب احتدام الصراع والمنافسة الشرسة؛ فقد رفعت شركة «أورا Oura» المصنعة للخواتم الذكية دعاوى قضائية ضد سبع شركات منافسة بتهمة انتهاك براءات الاختراع. وقد كسبت الشركة ثلاثاً من تلك القضايا، بينما لا تزال أربع قضايا أخرى منظورة أمام القضاء. وفي الوقت نفسه، تواجه ساعة «أبل ووتش (Apple Watch)» التي تبيع في خلال فصل ربع سنوي واحد نحو 8 ملايين وحدة، أكثر مما باعته «أورا» طوال تاريخها، ما لا يقل عن دعويين قضائيتين تتعلقان بانتهاك براءات الاختراع.

تكامل مع خدمات الرعاية الصحية

وفي خضم هذه المنافسة المحتدمة، اتخذت الشركات خطوات أولية نحو التكامل مع المستشفيات ومقدمي خدمات الرعاية الصحية؛ حيث عقدت «أبل» شراكة مع شركة «Epic Systems» العملاقة في مجال بيانات الرعاية الصحية، وكذلك عقدت شركة «أورا» شراكة مع شركة «ديكسكوم» (Dexcom) المصنّعة لأجهزة المراقبة المستمرة لمستوى الغلوكوز. ويفضل توم هيل، الرئيس التنفيذي لشركة «أورا» وصف منتجه بأنه «منصة للذكاء الصحي»، بدلاً من وصف «جهاز قابل للارتداء للياقة البدنية».

وكانت «غوغل» أطلقت، في شهر مايو (أيار)، الماضي تطبيق «Google Health»، الذي يجمع بين بيانات «فيتبت» وتطبيقات الطرف الثالث وسجلاتك الصحية؛ ويهدف التطبيق (على حد تعبير آندي أبرامسون، رئيس قسم المنتجات في «فيتبت») إلى أن يكون «المنصة الموحدة لإدارة جميع بياناتك الصحية». وفي العام الماضي، استحوذت شركة «سامسونغ»، التي تنتج خواتم وساعات ذكية، على شركة «Xealth» وهي منصة تربط البيانات الصحية للمستهلكين بأنظمة المستشفيات.

رصد الأمراض عن بُعد

مع تزايد اندماج الأجهزة القابلة للارتداء في نظام الرعاية الصحية، يرى الخبراء أن تحليل كل تلك البيانات سيتطلب مساعدة متطورة من الذكاء الاصطناعي، فضلاً عن ضرورة التعامل مع مخاوف جدية تتعلق بخصوصية البيانات.

لكن المزايا المحتملة مقنعة للغاية؛ فإلى جانب القدرة على رصد الأمراض في وقت أبكر بكثير مما هو متاح حالياً، يمكن لنظام الرعاية الصحية المدعوم بهذه الأجهزة أن يعزز فرص الرعاية الصحية عن بُعد بشكل هائل؛ إذ ستصبح الاختبارات التشخيصية، التي كانت تتطلب سابقاً زيارة المستشفى، غير ضرورية؛ حيث ستكون البيانات اللازمة (وهي كميات هائلة للغاية) قد أُرسلت بالفعل إلى الطبيب عبر الجهاز القابل للارتداء.

يقول الدكتور أندرو جاغيم، مدير أبحاث الطب الرياضي في نظام «مايو كلينك» الصحي الذي يدرس دقة الأجهزة القابلة للارتداء: «يمكنك معاينة أي مريض في أي وقت ومن أي مكان في العالم».

رصد المؤشرات الحيوية

ويرى الخبراء أن هذه التقنية تتمتع بموثوقية كافية لاستخدامها في بعض السياقات الطبية بالفعل. وبغض النظر عن شكلها، تعتمد الأجهزة القابلة للارتداء على مجموعة صغيرة من المستشعرات (مثل الكواشف الضوئية، ومقاييس التسارع، والمقاومات الحرارية) التي تتتبع تدفق الدم وحركتك ودرجة حرارة جلدك. ثم تقوم الخوارزميات المدمجة باستنتاج مؤشرات فسيولوجية (مثل معدل ضربات القلب ومراحل النوم ومستوى الأكسجين في الدم) انطلاقاً من البيانات الخام الأولية التي قد تكون مشوشة أو غير منتظمة.

وقال جاغيم إن دقة هذه الأجهزة تحسنت باطراد على مر السنين، لا سيما في تتبع الوقت الذي يقضيه المرء في النوم العميق أو مرحلة حركة العين السريعة (REM) مقارنة بالنوم الخفيف. وأشار جاغيم إلى أنه كان سيتجاهل تلك البيانات تماماً قبل عقد من الزمن، لكن الوضع اختلف الآن.

مسارات متعددة

مع سعي الشركات البارزة نحو التكامل مع قطاع الرعاية الصحية، فإنها تبني قواعد عملائها بطرق متنوعة. فمثلاً، تجذب سوارات «ووب (Whoop)»، التي يصل سعرها إلى 359 دولاراً سنوياً، شريحة المستهلكين الميسورين المهتمين باللياقة البدنية؛ إذ غالباً ما تُرتدى هذه السوارات مع ساعات باهظة الثمن أو حقائب يد فاخرة. لكنها كسبت أيضاً ولاء العديد من الرياضيين الذين يُقدّرون مؤشرات التعافي والإجهاد التي توفرها، التي تُترجم بيانات تقلب معدل ضربات القلب وبيانات النوم إلى مؤشر يومي.

أما ساعتا «أبل ووتش» و«فيتبيت» اللتان تُقدمان للمستخدمين مقاييس صحية أقل تفصيلاً، فتميلان إلى جذب شريحة أوسع من المهتمين بالصحة العامة، كما يقول جاغيم، بينما تجذب ساعات «غارمن (Garmin)» الذكية، المزودة بإمكانيات بتقنيات «جي بي إس» متقدمة وحتى قراءات الارتفاع في بعض الطرازات، الرياضيين المحترفين.

وقد أطلقت الشركة أخيراً سواراً ذكياً من دون شاشة. أما «أورا» التي يتميز أحدث إصداراتها بنحافة أي خاتم عادي، فقد استغلت شعبيتها بين النساء من خلال الترويج لميزات تتنبأ بالدورة الشهرية وفترة الإباضة.

أجهزة «أكثر استباقية»

أصبحت الأجهزة القابلة للارتداء أكثر استباقية أيضاً؛ فبدلاً من مجرد تتبع بيانات اللياقة البدنية، باتت تقدم توصيات حول كيفية الاستفادة منها: متى وكيف تتمرن، ومتى تنام وكم تأكل؟ وهنا تكمن ميزة العلامات التجارية الراسخة مثل «أبل» و«غوغل»، القادرة على استخلاص المعلومات من منتجات أخرى ضمن منظومتها، كما يقول بن أرنولد، محلل الصناعة في شركة «سيركانا».

ومع ذلك، لا يزال التكامل الكامل مع الرعاية الصحية في مراحله الأولى. وقال أوبراني: «يتحرك القطاع الطبي ببطء شديد ويتسم بالبيروقراطية المفرطة، وهناك عقبات حقيقية يجب تجاوزها».

* خدمة «نيويورك تايمز».


«نفايات» الذكاء الاصطناعي أدَّت إلى الحطّ من قيمة المحتوى الهادف وتلويث بيئة المعلومات

«نفايات» الذكاء الاصطناعي أدَّت إلى الحطّ من قيمة المحتوى الهادف وتلويث بيئة المعلومات
TT

«نفايات» الذكاء الاصطناعي أدَّت إلى الحطّ من قيمة المحتوى الهادف وتلويث بيئة المعلومات

«نفايات» الذكاء الاصطناعي أدَّت إلى الحطّ من قيمة المحتوى الهادف وتلويث بيئة المعلومات

لقد أغرقت أسوأ أنواع «نفايات» الذكاء الاصطناعي «AI slop» -أي المحتوى الرديء أو المفتعل بكثافة- نتائج بحث «غوغل» بوصفات لتحضير بيتزا مغطاة بالغراء، وقوائم «أمازون» بسير ذاتية وهمية، وخلاصات «فيسبوك» بصور لـ«إله الروبيان»... لقد تمددت أكوام «النفايات الرقمية» هذه عبر منصات التكنولوجيا، مما أدَّى إلى الحط من قيمة المحتوى الهادف وتلويث بيئة المعلومات، وذلك بالتزامن مع استمرار تطور روبوتات الدردشة وأدوات توليد الفيديو.

مساعٍ لإزالة النفايات

* «سبوتيفاي» أزالت 75 مليون ملف. والآن، يسعى وادي السيليكون إلى التخلص من هذه النفايات. فقد صرحت منصة «سبوتيفاي» بأنها أزالت 75 مليون ملف مرسل إليها بالجملة، وأزالت أغاني مكررة، ومقاطع صوتية أخرى تُصنف ضمن «الرسائل المزعجة خلال العام الماضي، وهو ما يمثل جزءاً كبيراً من إجمالي مكتبتها الصوتية.

* زر «لينكد إن». ومن جهتها أعلنت «لينكد إن» في يوليو (تموز) الماضي أن «محتوى الذكاء الاصطناعي الرديء يمثل أولوية قصوى لنا جميعاً»، وقامت بتطوير زرٍّ يُمكّن المستخدمين من الإبلاغ عنه.

* «يوتيوب» حذفت 130 ألف قناة من المحتوى ذي الجودة المتدنية. ووصف باحثون من شركة «غوغل»، الشركة الأم لـ«يوتيوب»، كيف قامت إحدى خدمات الفيديو بحذف 130 ألف قناة من المحتوى ذي الجودة المتدنية من منصتها خلال ستة أشهر.

* خدمات تجاهد لإزالة النفايات «الذكية». وفي جميع أنحاء الإنترنت، تُجري شركات التكنولوجيا عملية تنظيف شاملة للمحتوى المُولَّد، إذ تُعاني في كثير من الأحيان من نفس المحتوى الرديء الذي وفرته وأتاحته أدوات الذكاء الاصطناعي الخاصة بها. إذ تجاهد تطبيقات المراسلة الفورية، ومواقع تقييم المطاعم، والمحفوظات الأكاديمية، وخدمات التعارف، جميعها للعمل على استئصال أو التقليل من شأن المحتوى الرديء الذي يُولّده الذكاء الاصطناعي. ويعتمد الكثير منها على نفس التقنية لإتمام عملية التنظيف.

ضيق الجمهور من الذكاء الاصطناعي

وبدأ أفراد الجمهور يشعرون بالضيق من تأثير الذكاء الاصطناعي على البيئة وضغطه على الوظائف، وعلى الصحة النفسية. ووصف إيدان ووكر، صانع المحتوى والباحث الذي يدرس الاتجاهات على الإنترنت لصالح مؤسسة كارنيغي للسلام الدولي، وهي مركز أبحاث للشؤون العالمية، محتوى الذكاء الاصطناعي الرديء بأنه «جرحٌ مُتقيح» آخر». وأضاف: «أصبح المستخدمون أكثر استياءً من هذا الأمر تدريجياً». لقد تغيَّر المناخ العام بشكل ملحوظ، ولذا تواجه هذه الشركات أخيراً هذه المشكلات.

تقويض القيم الثقافية

ويستطيع الذكاء الاصطناعي التوليدي إنتاج صور ومقاطع صوتية ومرئية واقعية بشكل متزايد، لكن بعضها فقط يُصنف ضمن المحتوى الرديء. تستهدف شركات التكنولوجيا بشكل أساسي ذلك النوع من المحتوى الرخيص الذي يسهل إنتاجه ونشره واستهلاكه ونسيانه - حيث يطغى المحتوى الرخيص على المحتوى الراقي، ويحل المحتوى الرديء محل المحتوى الجيد.

وقد كتب باحثون أوروبيون العام الماضي أن هذا الكم الهائل من المحتوى الاصطناعي على الإنترنت، إذا لم يُضبط، قد «يُزاحم الإبداع البشري، ويُقوّض القيم الثقافية، ويُزعزع استقرار الخطاب العام».

وأصبح مصطلح «المحتوى الرديء» (المشار إليه بكلمة Slop الإنجليزية) شائعاً لدرجة أن دار نشر القواميس «ميريام-ويبستر» اختارته كلمة عام 2025.

موسيقى وفيديوهات مولدة اصطناعياً

وقالت «ديزر»، وهي خدمة بث موسيقى فرنسية، هذا الربيع إن ما يقرب من نصف المقاطع الصوتية التي تُضاف إلى نظامها يومياً مُولّدة اصطناعياً، وكثير منها لا يسمعه المستخدمون أبداً. كما يُولّد الذكاء الاصطناعي أكثر من ثلث ما يُرفع إلى «آبل ميوزيك».

وقال آدم موسيري، رئيس «إنستغرام»، أواخر العام الماضي إنه سيصبح قريباً «أكثر عملية» تتبُّع «المحتوى الحقيقي بدلاً من المحتوى المزيف». وجاءت ملاحظته بعد فترة وجيزة من إطلاق «ميتا»، الشركة الأم لـ«إنستغرام»، خدمة بث فيديو تعتمد كلياً على الذكاء الاصطناعي، والتي سخر منها الكثيرون باعتبارها منصة لعرض المحتوى الرديء.

شركات تكنولوجيا مبدعة... تولّد النفايات

إن العديد من شركات التكنولوجيا التي تحاول الآن التعامل مع مشكلة «المحتوى الرديء الناتج عن الذكاء الاصطناعي» هي نفسها الشركات التي تُسهم في تفاقم هذه الظاهرة. ففي شهر يوليو الماضي، تعهدت شركة «ميتا» بدعم اتفاقية أوروبية تهدف إلى جعل المحتوى المُنتَج بواسطة الذكاء الاصطناعي أكثر قابلية للتمييز من خلال آليات الكشف والتصنيف والوسم. وفي الشهر ذاته، أطلقت الشركة أداة لتوليد الصور تعتمد تلقائياً على محتوى الحسابات العامة في «إنستغرام» كمصدر مرجعي لعملها (وهي الميزة التي سحبتها «ميتا» لاحقاً بعد ثلاثة أيام من ردود الفعل الغاضبة).

تراكم كميات هائلة من المواد الهامشية وعديمة القيمة

يقول بول شوفلين، خبير الذكاء الاصطناعي في جامعة أوهايو: «يُعد هذا المحتوى الرديء الناتج عن الذكاء الاصطناعي سلاحاً ذا حدين؛ فمن ناحية، شهدت العديد من المنصات ارتفاعاً في معدلات التفاعل بفضله. ولكن من ناحية أخرى، وصل الأمر إلى مرحلة أصبح فيها هذا المحتوى يمثل عبئاً ومصدر مشكلة، إذ تراكمت كميات هائلة من المواد الهامشية وعديمة القيمة، لدرجة بات معها من الصعب على المستخدمين العثور على المحتوى عالي الجودة الذي يبحثون عنه».

20 % من مقاطع الفيديو القصيرة في يوتيوب «اصطناعية»

وعلى سبيل المثال، استثمرت شركة «غوغل» بكثافة في الذكاء الاصطناعي، وربطت نموذجها «جيميناي» بخدمات البريد الإلكتروني والخرائط والسفر والبحث. ووفقاً لتجربة أجرتها شركة «كابوينغ» العام الماضي، وهي شركة تحرير للفيديو عبر الإنترنت تعمل بالذكاء الاصطناعي، فإن أكثر من 20 في المائة من مقاطع الفيديو القصيرة الأولى التي تُعرض للمستخدمين الجدد على «يوتيوب» هي محتوى رديء مُولّد بواسطة الذكاء الاصطناعي.

أرباح «اصطناعية» كبيرة

وقدّرت «كابوينغ» أن إحدى أشهر قنوات «يوتيوب» التي تُنتج هذا النوع من المحتوى حققت أرباحاً سنوية بلغت 4.25 مليون دولار. (وقد تم تعليقها لاحقاً من برنامج تحقيق الربح على «يوتيوب»). وكتب نيل موهان، الرئيس التنفيذي لـ«يوتيوب»، في منشور على مدونته أن «إدارة المحتوى الرديء المُولّد بواسطة الذكاء الاصطناعي» كانت من أهم أولويات هذا العام.

اللجوء إلى المستخدمين لرصد النفايات «الذكية»

وتلجأ شركات أخرى إلى مجموعة متنوعة من الاستراتيجيات لمعالجة المحتوى غير المتوافق مع الذكاء الاصطناعي، بما في ذلك حشد مستخدميها للمساعدة في تحديده. ففي أكتوبر (تشرين الأول) الماضي، حدّثت «بينترست» نظامها للسماح للمستخدمين بالحد من عدد المنشورات التي يُنشئها الذكاء الاصطناعي التي يرونها. وقالت «تيك توك» إنها تختبر ميزة في الولايات المتحدة تُمكّن المستخدمين من التحكم في كمية المحتوى المرئي المُنشأ بواسطة الذكاء الاصطناعي. كما ذكرت الشركة أنها صنّفت تلقائياً أكثر من 3 مليارات مقطع فيديو مُنشأ بواسطة الذكاء الاصطناعي. وقد حذفت «تيك توك» أكثر من 377 ألف مقطع فيديو في الأشهر الثلاثة الأولى من العام لمخالفتها سياسات الذكاء الاصطناعي الخاصة بها.

نصف المنشورات القصيرة على «إكس» اصطناعية

تم استخدام الذكاء الاصطناعي لإنشاء ما يقرب من نصف المنشورات التي تحتوي على أكثر من 50 كلمة على منصة التواصل الاجتماعي «إكس» وفقاً لشركة «بانغرام» Pangram، وهي شركة ناشئة متخصصة في اكتشاف الذكاء الاصطناعي. وكتب نيكيتا بير، الذي شغل منصب رئيس قسم المنتجات في منصة «إكس» حتى وقت سابق من هذا الشهر، أن المنصة حظرت هذا العام التطبيقات التي تشجع فعلياً برمجيات الروبوت (البوتات) على النشر من خلال الدفع مقابل المحتوى، وذلك بهدف التعامل مع «كميات هائلة من المحتوى الرديء الناتج عن الذكاء الاصطناعي ورسائل الرد المزعج».

وفي الشهر الماضي، كتب كريس بيست، الرئيس التنفيذي لمنصة «سابستاك» (Substack)، أن «التمييز بين ما هو حقيقي وما هو زائف على الإنترنت يزداد صعوبة»، وأن «المنصات التي تكافئ الزيف ستؤدي إلى سباق نحو الأسوأ». وقد أعلنت المنصة عن إطلاق أداة خاصة بها لمستخدميها للكشف عن المحتوى المُنتج بواسطة الذكاء الاصطناعي - مدعومة بتقنية من شركة «بانغرام» صُممت لمسح الردود والتعليقات والمنشورات التي تتجاوز 100 كلمة، وتحديد ما إذا كانت قد كُتبت يدوياً على الأرجح أم بمساعدة الذكاء الاصطناعي.

وقد اشتكى بعض كُتّاب النشرات الإخبارية من أن الأداة صنفت منشورات كتبها بشر على أنها ناتجة عن الذكاء الاصطناعي، ولم تأخذ في الحسبان الدور المحتمل للذكاء الاصطناعي في العملية الإبداعية، كما أنها وضعت ضغوطاً غير مبررة على المؤلفين للدفاع عن سمعتهم في مواجهة معيار غامض وغير شفاف.

مصاعب تصنيف المحتوى الرديء

وفي ربيع هذا العام اجتمعت كاميل فرانسوا ونحو عشرين خبيراً آخرين في مجال الذكاء الاصطناعي في فعالية «سلوب صالون» (Slop Salon) في مينلو بارك بولاية كاليفورنيا، حيث ناقشوا صعوبة تصنيف - وبالتالي إدارة - المحتوى الرديء الناتج عن الذكاء الاصطناعي.

وقالت فرانسوا، التي تدرس التقنيات الرقمية الضارة في جامعة كولومبيا، في مقابلة أجريت معها: «إن هذا المزيج المتنوع من الأساليب المتبعة يشير إلى أننا نواجه مشكلة هيكلية في بيئة المعلومات لدينا. ولا يقتصر الأمر على مجرد فئة سيئة من المحتوى، يمكننا ببساطة تعريفها وإزالتها». وأضافت: «في نهاية المطاف، يُعد الذكاء الاصطناعي أداة إبداعية متعددة الأوجه، لذا ستشهد المنصات التي تتعامل مع هذا الأمر بشكل سيء، عزوف المستخدمين وانتقالهم إلى منصات أخرى».

* خدمة «نيويورك تايمز».