«GPT-Live» نموذج صوتي جديد من «أوبن إيه آي» يستمع ويتحدث في الوقت نفسه

يحوّل الصوت إلى واجهة أكثر تقدماً للذكاء الاصطناعي

يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)
يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)
TT

«GPT-Live» نموذج صوتي جديد من «أوبن إيه آي» يستمع ويتحدث في الوقت نفسه

يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)
يستطيع النموذج الاستماع والتحدث في الوقت نفسه بدلاً من انتظار انتهاء المستخدم من الكلام قبل الرد (شاترستوك)

أطلقت «أوبن إيه آي» جيلاً جديداً من نماذج الصوت باسم «جي بي تي لايف» (GPT-Live) في خطوة تهدف إلى جعل التحدث مع «تشات جي بي تي» أقرب إلى محادثة بشرية طبيعية، لا تبادل أوامر متقطعة بين المستخدم والنظام. ويبدأ طرح النموذج عالمياً داخل تجربة «ChatGPT Voice» عبر نسختين هما «GPT-Live-1» و«GPT-Live-1 mini» على أن يصل لاحقاً إلى واجهة البرمجة للمطورين والشركات.

الاستماع والتحدث معاً

الفرق الأساسي في النموذج الجديد أنه يعتمد على بنية تعرف باسم «full-duplex» أي أنه يستطيع الاستماع والتحدث في الوقت نفسه. في النماذج الصوتية السابقة، كان النظام ينتظر غالباً انتهاء المستخدم من الكلام قبل أن يبدأ في الرد، مما يجعل الحوار أقرب إلى جولات منفصلة. أما في النموذج الجديد، فيستطيع النظام متابعة الكلام، أو الصمت عندما يحتاج المستخدم إلى التفكير، أو الرد السريع، أو استخدام عبارات قصيرة تدل على أنه يتابع الحديث.

تقول «أوبن إيه آي» إن «GPT-Live» يستطيع اتخاذ قرارات تفاعلية مرات عدة في الثانية، مثل أن يتكلم أو يواصل الاستماع أو يتوقف أو يقاطع أو يستدعي أداة أخرى. هذا التحول مهم لأن كثيراً من الإحباط في تجارب الصوت السابقة كان ناتجاً عن سوء تقدير لحظة انتهاء الكلام، خصوصاً عند وجود توقف قصير أو ضوضاء في الخلفية.

يمكن للنموذج الاستعانة بنماذج أقوى في الخلفية عند الحاجة إلى تحليل أعمق أو تنفيذ مهام أكثر تعقيداً (رويترز)

تفاعل مستمر

توضح الشركة أن أجيالاً سابقة من أنظمة الصوت اعتمدت على سلسلة من النماذج المتتابعة أي نموذج يحول الكلام إلى نص، ثم نموذج لغوي ينتج الإجابة، ثم نموذج آخر يحول النص إلى صوت. هذه الطريقة فتحت الباب أمام المحادثة الصوتية مع نماذج متقدمة، لكنها كانت بطيئة نسبياً، وقد تفقد بعض المعلومات أثناء انتقالها بين النماذج.

أما «Advanced Voice Mode» فاختصر بعض هذه الخطوات عبر معالجة الصوت وإنتاجه داخل نموذج واحد، لكنه ظل قائماً على مبدأ الأدوار المنفصلة بين المستخدم والنظام. لذلك لم يكن الحوار دائماً بالمرونة نفسها التي تحدث في المحادثات البشرية، حيث يمكن للشخصين المقاطعة والتوضيح والتوقف والمتابعة بصورة طبيعية.

يحاول «GPT-Live» تجاوز هذا القيد عبر معالجة مستمرة للمدخلات الصوتية أثناء توليد الرد، مما يسمح بتدفق أكثر مرونة. وتقول الشركة إن ذلك يدعم أيضاً استخدامات مثل الترجمة المباشرة، لأن النظام لا يحتاج إلى انتظار انتهاء مقطع طويل قبل أن يبدأ في التعامل معه.

عقل أعمق في الخلفية

لا يقتصر التغيير على أسلوب الحوار حيث إن النموذج الجديد يفصل بين طبقة التفاعل الصوتي السريع والمهام التي تحتاج إلى تفكير أعمق أو بحث أو تنفيذ خطوات أكثر تعقيداً. عند الحاجة، يمكن لـ«GPT-Live» أن يحيل المهمة إلى نموذج أكثر تقدماً في الخلفية، مثل «GPT-5.5» عند الإطلاق، ثم يعيد النتيجة إلى المحادثة عندما تصبح جاهزة.

هذا التصميم يعالج مشكلة عملية في واجهات الصوت. فالمستخدم لا يريد أن تتحول كل مهمة صعبة إلى صمت طويل، ولا يريد في الوقت نفسه إجابة سطحية لمجرد الحفاظ على سرعة الحوار. لذلك يحاول النظام الجمع بين الاستجابة الصوتية السريعة والقدرة على الاستعانة بنموذج أقوى للبحث أو التحليل أو تنفيذ مهام أكثر تعقيداً.

وتشير «أوبن إيه آي» إلى أن هذا النهج قد يفتح لاحقاً المجال أمام استخدام الصوت في أعمال أطول وأكثر تعقيداً وذات طابع وكيل، حيث لا يكتفي النموذج بالرد، بل يساعد في إنجاز مهام متعددة أثناء استمرار المحادثة.

يهدف «GPT-Live» إلى تحسين سلاسة الحوار الصوتي خصوصاً عند المقاطعة أو التوقف أو وجود ضوضاء في الخلفية (رويترز)

تجربة جديدة داخل «تشات جي بي تي»

مع الطرح الجديد، يصبح «GPT-Live» المحرك الافتراضي لتجربة الصوت في «تشات جي بي تي». وستحصل خطط «Go» و«Plus» و«Pro» على: «GPT-Live-1» بينما تعتمد الخطة المجانية على «GPT-Live-1 mini». وتقول الشركة إن أكثر من 150 مليون شخص يستخدمون أسبوعياً ميزات مثل الصوت والإملاء داخل «تشات جي بي تي»، سواء للمساعدة اليومية من دون استخدام اليدين، أو ممارسة اللغات، أو المحادثة أثناء التنقل.

وتتضمن التجربة الجديدة قدرة أفضل على الاستماع في ظروف أقل مثالية، مثل وجود ضوضاء في الطريق أو محادثات قريبة، إضافة إلى إمكانية أن يطلب المستخدم من النظام أن ينتظر أو يصمت أو يبطئ إيقاعه. كما أعادت الشركة تحسين الأصوات التسعة المتاحة في «تشات جي بي تي» لتناسب النموذج الجديد.

وتضيف «أوبن إيه آي» أن الصوت سيستمر في دعم البحث والذاكرة والصور ورفع الملفات، مع إمكانية عرض بطاقات مرئية لبعض الإجابات، مثل الطقس أو الأسهم أو الرياضة، أثناء استمرار المحادثة الصوتية.

السلامة في محادثة فورية

لأن الصوت أكثر قرباً وحساسية من النص، خصصت الشركة جانباً من الإعلان لإجراءات السلامة. فقد وسّعت اختبارات النموذج لتشمل تقييمات صوتية مرتبطة بمخاطر مثل إيذاء النفس، والاعتماد العاطفي على الذكاء الاصطناعي، والعنف، والمحتوى الجنسي. كما تقول إن النظام يملك آليات يمكن أن تتدخل أثناء الكلام إذا رصدت مخرجات غير آمنة، إما بتوجيه الرد نحو مسار أكثر أماناً، أو عرض موارد دعم، أو إنهاء المحادثة في الحالات الأعلى خطراً.

وتقول الشركة أيضاً إن «GPT-Live» مصمم للمحادثة لا لتقليد أصوات أشخاص حقيقيين، ويستخدم مجموعة محددة مسبقاً من الأصوات داخل «تشات جي بي تي»، مع ضوابط تمنع انتحال الأصوات.

حدود الإطلاق

رغم الطرح الواسع، لا تزال هناك حدود واضحة. فالنموذج لا يدعم عند الإطلاق استخدام الصوت مع الفيديو أو مشاركة الشاشة داخل «تشات جي بي تي»، مع أن الشركة تقول إنها تعمل على إضافة هذه القدرات لاحقاً. كما تشير إلى أن النموذج محسن لبعض اللغات الأكثر استخداماً في «تشات جي بي تي»، وأن بعض اللغات قد تظهر فيها لكنة غير أصلية أو فجوات في الطلاقة.

يمثل «GPT-Live» محاولة لنقل الذكاء الاصطناعي الصوتي من مرحلة الأوامر المتبادلة إلى واجهة أكثر استمرارية، تستطيع الاستماع والتحدث والانتظار والاستعانة بنماذج أقوى في الخلفية. وإذا نجح هذا الاتجاه، فقد يصبح الصوت واجهة رئيسية للتعامل مع الذكاء الاصطناعي، ليس فقط للسؤال والجواب، بل للتعاون على مهام يومية أطول وأكثر تعقيداً.


مقالات ذات صلة

«شات جي بي تي» يطلق تجربة جديدة لإدارة المهام المجدولة ويعزز قدراته الاستباقية

تكنولوجيا الميزة تُطرح الآن تدريجياً على الويب والجوال (ChatGPT)

«شات جي بي تي» يطلق تجربة جديدة لإدارة المهام المجدولة ويعزز قدراته الاستباقية

تهدف الخطوة إلى تحويل المساعد الذكي من أداة للإجابة عن الأسئلة إلى مساعد رقمي قادر على متابعة المهام وتنفيذها بشكل تلقائي ومنظم داخل التطبيق والويب.

عبد العزيز الرشيد (الرياض)
تكنولوجيا شعار برنامج «شات جي بي تي» يظهر إلى جانب يد روبوت في صورة مركبة (رويترز)

مبتكر «شات جي بي تي» يدعو لكبح تطوير الذكاء الاصطناعي

وسط التسارع غير المسبوق في تطوير تقنيات الذكاء الاصطناعي، تتزايد المخاوف العالمية من تداعيات هذه الطفرة على مستقبل البشرية.

«الشرق الأوسط» (واشنطن)
تكنولوجيا بعض نماذج اللغة الحديثة بدت بشرية بدرجة جعلت المشاركين يختارونها أحياناً على أنها الطرف الإنسان

دراسة تختبر قدرة الذكاء الاصطناعي على تقليد البشر في المحادثة

تظهر دراسة جديدة أن بعض نماذج الذكاء الاصطناعي باتت قادرة على محاكاة المحادثة البشرية وإرباك المشاركين في اختبار «تورينغ».

نسيم رمضان (لندن)
تكنولوجيا بعض المستخدمين يعتقدون أن استخدام عبارات مهذبة قد يُسهم في تحسين استجابة الذكاء الاصطناعي (أ.ف.ب)

«من فضلك» و«شكراً»... هل تؤثر اللباقة على أداء الذكاء الاصطناعي؟

تشير نتائج استطلاع حديث إلى أن الطريقة التي نخاطب بها أنظمة الذكاء الاصطناعي قد تكون أكثر تأثيراً مما يُعتقد.

«الشرق الأوسط» (واشنطن)
تكنولوجيا عبارة «مرحباً بكم في أوبن إيه آي» تظهر على الصفحة الرئيسية لـ«شات جي بي تي» (د.ب.أ)

ميزة جديدة في «شات جي بي تي» تُخطر المقربين عند الأزمات النفسية

أعلنت «أوبن إيه آي» عن إطلاق ميزة أمان جديدة ضمن تطبيق «شات جي بي تي»، تهدف إلى التدخل المبكر في حالات الطوارئ المرتبطة بالصحة النفسية.

«الشرق الأوسط» (واشنطن)

29 دولة توقّع اتفاقاً لإنشاء منظمة عالمية للتعاون في مجال الذكاء الاصطناعي

وزير الخارجية الصيني وانغ يي يصافح أنطونيو غوتيريش الأمين العام للأمم المتحدة قبيل التقاط صورة جماعية للموقّعين على اتفاق إنشاء «المنظمة ​العالمية للتعاون في مجال الذكاء الاصطناعي» (إ.ب.أ)
وزير الخارجية الصيني وانغ يي يصافح أنطونيو غوتيريش الأمين العام للأمم المتحدة قبيل التقاط صورة جماعية للموقّعين على اتفاق إنشاء «المنظمة ​العالمية للتعاون في مجال الذكاء الاصطناعي» (إ.ب.أ)
TT

29 دولة توقّع اتفاقاً لإنشاء منظمة عالمية للتعاون في مجال الذكاء الاصطناعي

وزير الخارجية الصيني وانغ يي يصافح أنطونيو غوتيريش الأمين العام للأمم المتحدة قبيل التقاط صورة جماعية للموقّعين على اتفاق إنشاء «المنظمة ​العالمية للتعاون في مجال الذكاء الاصطناعي» (إ.ب.أ)
وزير الخارجية الصيني وانغ يي يصافح أنطونيو غوتيريش الأمين العام للأمم المتحدة قبيل التقاط صورة جماعية للموقّعين على اتفاق إنشاء «المنظمة ​العالمية للتعاون في مجال الذكاء الاصطناعي» (إ.ب.أ)

وقعت 29 دولة، اليوم (الخميس)، اتفاقاً لإنشاء «المنظمة العالمية للتعاون في مجال الذكاء الاصطناعي»، وهي هيئة حكومية دولية تقول الصين إنها تهدف إلى تعزيز التعاون الدولي والحوكمة العالمية للذكاء الاصطناعي.

ووقَّع ‌ممثلو 29 ‌دولة، ​منها: ‌روسيا وبيلاروسيا وصربيا وكوبا والبرازيل وفنزويلا، بالإضافة إلى 10 دول أفريقية و12 دولة آسيوية، على الاتفاق بصفتهم أعضاء مؤسسين.

وذكرت «وكالة أنباء الصين الجديدة (شينخوا)» أن مقر ‌المنظمة سيكون ‌في مدينة شنغهاي، وفقاً لوكالة «رويترز».

و​جرت ‌مراسم التوقيع في شنغهاي، ‌عشية انطلاق المؤتمر العالمي السنوي للذكاء الاصطناعي؛ حيث من المتوقَّع أن يعرض الرئيس الصيني ‌شي جينبينغ رؤية بكين لدورها في صياغة قواعد الحوكمة العالمية للذكاء الاصطناعي.

وطرحت الصين فكرة إنشاء «المنظمة العالمية للتعاون في مجال الذكاء الاصطناعي»، خلال نسخة العام الماضي من المؤتمر، لكن لم تعلن أي دولة رسمياً عن انضمامها إلى المنظمة حتى الآن.


هل يهدد الإفراط في استخدام الذكاء الاصطناعي قدرات البشر؟

تطبيقات الذكاء الاصطناعي على شاشة هاتف ذكي (د.ب.أ)
تطبيقات الذكاء الاصطناعي على شاشة هاتف ذكي (د.ب.أ)
TT

هل يهدد الإفراط في استخدام الذكاء الاصطناعي قدرات البشر؟

تطبيقات الذكاء الاصطناعي على شاشة هاتف ذكي (د.ب.أ)
تطبيقات الذكاء الاصطناعي على شاشة هاتف ذكي (د.ب.أ)

بات الذكاء الاصطناعي يضطلع يوماً بعد آخر بدور متزايد في إنجاز مجموعة واسعة من المهام، بدءاً من كتابة الرسائل الإلكترونية والبرمجة وصولاً إلى الترجمة وتنظيم الرحلات، ما يثير تساؤلات بشأن احتمال تراجع القدرات المعرفية لدى البشر على المدى البعيد.

أحدث ظهور روبوتات المحادثة القائمة على الذكاء الاصطناعي التوليدي مثل «تشات جي بي تي»، والقادرة على إنشاء شتى أنواع المحتويات استجابة لطلبات بسيطة بلغة يومية، تحوّلاً في أنماط الاستخدام داخل المدارس وأماكن العمل وكذلك في الحياة اليومية.

وأظهرت أبحاث علمية حديثة شملت أعداداً محدودة أن الاعتماد على الذكاء الاصطناعي لتولي بعض المهام قد تكون له تداعيات سلبية على الذاكرة، والقدرة على اتخاذ قرارات، والتفكير النقدي.

عبارة «الذكاء الاصطناعي» ولوحة مفاتيح وأيدٍ روبوتية في هذا الرسم التوضيحي (رويترز)

في أبريل (نيسان)، توصّلت دراسة أميركية بريطانية لا تزال تخضع لمراجعة إلى أنّ استخدام هذه الأدوات لحل مسائل حسابية أو إنجاز تمارين مرتبطة بفهم النصوص المقروءة حسّن أداء المشاركين على المدى القصير، لكنه أثّر سلباً على أدائهم على المدى البعيد وقدرتهم على المثابرة عند وقف الاعتماد على الذكاء الاصطناعي.

وكتب معدّو الدراسة التي أُجريت على 1222 شخصاً إنّ «هذه النتائج تثير قلقاً كبيراً، لأن المثابرة عنصر أساسي في اكتساب المهارات وأحد أفضل المؤشرات إلى التعلم على المدى البعيد».

في حديث إلى «وكالة الصحافة الفرنسية»، أوضحت المعدّة الرئيسية للدراسة غريس ليو أنّ الذكاء الاصطناعي الذي يُشاد به لسرعته في العمليات الحسابية، يُعوّد الناس على توقع إجابة فورية، وهو ما «يسلبهم فرصاً للتعلّم».

وأضافت: «المقلق هو أن الذكاء الاصطناعي لا يقتصر على أداء مهمة بعينها، بل يمكن توظيفه في مختلف الأنشطة الفكرية التي تعتمد على التحليل والاستنتاج»، على عكس الآلة الحاسبة التي تُساعد في حل المعادلات الحسابية، لكنها تترك عملية التفكير للمستخدم.

«توفير الجهد»

أظهرت دراسة أجراها معهد ماساتشوستس للتكنولوجيا عام 2025 أن التلاميذ الذين يستخدمون الذكاء الاصطناعي التوليدي لكتابة موضوعات إنشائية هم أقلّ قدرة على التفكير النقدي.

وتدعم دراسات أخرى هذه النتيجة، مُسلطة الضوء على ظاهرة تُعرف باسم «التفويض المعرفي»، أو حتى «تراجع الانخراط الذهني».

وقال يوهان شوفالير، الباحث في مختبر علم النفس الاجتماعي والمعرفي التابع للمركز الفرنسي للبحوث العلمية، لـ«وكالة الصحافة الفرنسية»، إنّ «البشر يميلون بشدة إلى توفير الجهد».

وأضاف: «في حياتنا اليومية، غالباً ما نستخدم استراتيجيات تُوصلنا إلى الهدف بسرعة أكبر، من دون الخوض بالضرورة في المعلومات المُراد معالجتها، وهو أمر يتطلب جهداً معرفياً كبيراً»، مشيراً إلى أن الذكاء الاصطناعي التوليدي يُعزز هذا الميل.

وتابع: «إذا كانت هناك أنشطة لا يمارسها الشخص مطلقاً، فإن دماغه الذي يعمل على أساس توفير الطاقة، لن يُكلّف نفسه عناء الحفاظ على روابط عصبية لا تُستخدم».

تطبيقات للذكاء الاصطناعي (أ.ف.ب)

تحفيز التفكير

ولتقليل هذه الآثار والحد من الانتقادات، ابتكرت الشركات المتخصصة في نماذج الذكاء الاصطناعي أدوات تعليمية تقوم على النهج السقراطي، وتستهدف خصوصاً التلاميذ.

لا تُولّد روبوتات المحادثة إجابات تلقائية، بل تُقدّم تلميحات وتطرح أسئلة لتحفيز التفكير، مثل خاصية «دراسة» في «تشات جي بي تي» أو خاصية «التعلم الموجّه» في «جيميناي».

وأفادت شركة «مايكروسوفت» بأنها أضافت تنبيهات بشأن احتمال وقوع أخطاء، وتذكيرات بالتحقق من المعلومات، وتدابير متنوعة لتشجيع المستخدمين على المشاركة الفعّالة والنقدية في الإجابات التي تولدها الأداة.

عبارة «الذكاء الاصطناعي» (أ.ف.ب)

وأشارت «مايكروسوفت» إلى أنّ «خطر الاعتماد المفرط على التفويض المعرفي قائم، خصوصاً عندما يُستخدم الذكاء الاصطناعي لأتمتة المهام التي تساعد بدورها في تطوير المهارات»، مشددة على أهمية تدريب المستخدمين على التعامل مع هذه الأدوات.

لا تزال ثمة حاجة إلى دراسات واسعة النطاق وطويلة الأمد لمعرفة التأثير الفعلي لهذه التكنولوجيا الجديدة على أدمغة البشر، على ما أكد باحثون.

وقال شوفالير: «يقع على عاتقنا استخدام الذكاء الاصطناعي بذكاء»، حتى وإن تطلب ذلك جهداً، مضيفاً: «سنتكيّف مع هذه الثورة التكنولوجية كما تكيّفنا مع الثورات السابقة».


دُور نشر تقاضي «غوغل» بتهمة استخدام كتب لتدريب الذكاء الاصطناعي

شعار شركة غوغل (رويترز)
شعار شركة غوغل (رويترز)
TT

دُور نشر تقاضي «غوغل» بتهمة استخدام كتب لتدريب الذكاء الاصطناعي

شعار شركة غوغل (رويترز)
شعار شركة غوغل (رويترز)

أقامت مجموعة من دُور نشر ومؤلفين دعاوى قضائية على شركة غوغل، الثلاثاء، يتهمونها فيها بانتهاك حقوق النشر عبر استخدام محتوى محميّ لتدريب نماذج الذكاء الاصطناعي التابعة لها، ثم إنتاج محتوى ينافس مباشرةً أعمال المؤلفين الأصليين.

جاء في الدعوى أن «حجم وسرعة قدرة نموذج (جيميناي) على إنتاج الكتب ومنافسة الكُتّاب البشر أمر غير مسبوق».

وأقيمت الدعوى أمام محكمة في نيويورك بصيغة دعوى جماعية من جانب دُور النشر «هاشيت بوك غروب» و«سنغيج ليرنينغ» و«إلسيفير»، إضافة إلى الكاتب سكوت تورو وشركته S.C.R.I.B.E للنشر، وفقاً لما ذكرته «وكالة الصحافة الفرنسية».

ويتهم المدّعون «غوغل» بأنها «نسخت سراً ملايين الأعمال» التي كانت حصلت عليها عبر خدمة «غوغل بوكس» وخدمات أخرى لأغراض محددة، ثم استخدمت تلك المواد لتدريب نموذج الذكاء الاصطناعي «جيميناي».

كما يؤكدون أن المحتوى الذي يولّده «جيميناي» ينافس، بصورة مباشرة، الأعمال الأصلية التي ألّفها أصحاب الحقوق.

وأضافت الدعوى: «يقوم (جيميناي) حتى بتخصيص مُخرجاته لمحاكاة العناصر التعبيرية والخيارات الإبداعية لمؤلفين محددين».

وتُعد هذه أحدث قضية تتعلق بحقوق النشر تقام على شركات مطوّرة للذكاء الاصطناعي.

وكانت مجموعة من دُور النشر؛ من بينها «هاشيت» و«سنغيج» و«إلسيفير»، بالإضافة إلى سكوت تورو، قد أقامت، في مايو (أيار) الماضي، دعوى مماثلة على شركة «ميتا» أمام محكمة في نيويورك.

وفي سبتمبر (أيلول) الماضي، وافق قاض أميركي على تسوية بقيمة 1.5 مليار دولار بين شركة «أنثروبيك» وعدد من المؤلفين الذين اتهموها بنَسخ أعمالهم بصورة غير قانونية لتدريب نموذجها للذكاء الاصطناعي «كلود».

وشكَّل القرار انتصاراً جزئياً لـ«أنثروبيك»، إذ رأى القاضي أن استخدام الكتب لتدريب النموذج يمكن عدُّه «استخداماً عادلاً»، بموجب القانون الأميركي، في حين عدَّ أن استخدامات أخرى لمواد مُقرصنة غير قانونية.