GPT-Live يتيح التحدث والاستماع في الوقت نفسه

GPT-Live يتيح التحدث والاستماع في الوقت نفسه

أخبارنا المغربية - وكالات

طورت شركة OpenAI نظاماً صوتياً جديداً يحمل اسم «GPT-Live»، يستطيع الاستماع إلى المستخدم والتحدث معه في الوقت نفسه، في محاولة لجعل الحوار مع الذكاء الاصطناعي أكثر سلاسة وقرباً من المحادثات البشرية الطبيعية.

ويعتمد النظام على بنية صوتية مزدوجة الاتجاه، لا تنتظر انتهاء المستخدم من حديثه قبل بدء الرد. ويستطيع النموذج متابعة التوقفات القصيرة والمقاطعات وتغير سرعة الكلام، وتحديد اللحظة المناسبة للرد أو الاستمرار في الاستماع.

وألغت OpenAI ما يُعرف بكاشف الأدوار من المسار الصوتي الرئيسي، ما يسمح باستمرار تدفق الصوت في الاتجاهين. ويمكن للنظام إظهار انتباهه بعبارات قصيرة، أو الدخول في تبادل سريع للكلام، أو التزام الصمت عندما يحتاج المستخدم إلى وقت للتفكير.

ويستطيع «GPT-Live» الاستعانة بنموذج أكثر قوة في الخلفية عند الحاجة إلى البحث على الإنترنت أو تنفيذ أدوات أو إجراء استدلال أعمق، مع مواصلة المحادثة الصوتية دون توقف. واعتمد النظام عند إطلاقه على «GPT-5.5» لمعالجة المهام الأكثر تعقيداً.

واعتمدت الشركة تقنية «WebRTC» لنقل الصوت بزمن استجابة منخفض والحفاظ على استقرار الاتصال، حتى عند تغير جودة الشبكة أو فقدان بعض حزم البيانات. وتوفر التقنية أيضاً أدوات لمعالجة الصدى وتقلب زمن وصول الصوت وتشفير الاتصالات.

وتفتح هذه البنية الطريق أمام استخدام الصوت واجهةً لتشغيل وكلاء الذكاء الاصطناعي وتنفيذ المهام داخل التطبيقات، بدلاً من اقتصار دوره على طرح الأسئلة وتلقي الإجابات. كما تتيح تقنيات OpenAI للمطورين إنشاء وكلاء صوتيين قادرين على استخدام الأدوات والتعامل مع المقاطعات وتنفيذ إجراءات مباشرة أثناء الحوار.


هل ترغب بالتعليق على الموضوع؟

*
*
*
ملحوظة
  • التعليقات المنشورة لا تعبر بالضرورة عن رأي الموقع
  • من شروط النشر: عدم الإساءة للكاتب أو للأشخاص أو للمقدسات
المقالات الأكثر مشاهدة