العودة للرئيسية
تكنولوجيا

طريقة استخدام وضع الصوت الجديد في ChatGPT

يتيح GPT-Live محادثات صوتية متزامنة وأكثر سلاسة في ChatGPT، مع مستويات Instant وMedium وHigh وخيارات تختلف بحسب خطة الاشتراك، لكنه لا يدعم حاليًا مشاركة الشاشة أو الفيديو.

صوتيصوتي
صوتي3 دقائق

استمع إلى المقال

نسخة صوتية مولّدة آلياً.

0:00
0:00
طريقة استخدام وضع الصوت الجديد في ChatGPT

يقدّم وضع الصوت الجديد في ChatGPT محادثات أكثر سلاسة عبر نموذج GPT-Live، الذي يستمع ويتحدث في الوقت نفسه، مع ثلاثة مستويات للاستجابة تختلف في السرعة ومدة التفكير. ويتوفر الوضع عبر تطبيق ChatGPT على أجهزة iPhone وAndroid ومتصفح الويب، فيما تختلف نسخة النموذج المتاحة بين الخطط المجانية والمدفوعة.

طريقة تشغيل وضع الصوت

يمكن بدء المحادثة بالضغط على أيقونة الصوت، التي تظهر على هيئة موجة صوتية في أقصى يمين مربع الكتابة. وعند استخدام الوضع للمرة الأولى، يطلب التطبيق إذن الوصول إلى ميكروفون الجهاز، ثم تظهر دائرة عائمة متحركة على الشاشة ويستطيع المستخدم التحدث بصورة طبيعية.

يظل وضع الصوت نشطًا عند الانتقال إلى تطبيق آخر أو قفل شاشة الهاتف. كما يمكن للمستخدم مقاطعة ChatGPT أو مواصلة الكلام من دون انتظار انتهاء الرد بالكامل، إذ أصبح النموذج أقل ميلًا إلى اعتبار التوقف القصير نهاية للجملة، بما يستهدف تحسين سلاسة المحادثات الطويلة.

ثلاثة مستويات للاستجابة

يمكن تغيير مستوى ذكاء نموذج الصوت من أيقونة الإعدادات أعلى الشاشة. ويبدأ GPT-Live تلقائيًا بمستوى Instant، فيما يستطيع إحالة الأسئلة التي تتطلب بحثًا أو تفكيرًا أعمق إلى نماذج أخرى في الخلفية. وقد يؤدي اختيار Medium أو High إلى زيادة زمن الاستجابة ثانية أو ثانيتين، خصوصًا عند مناقشة موضوعات معقدة بصورة متكررة.

كيف تطور وضع الصوت؟

كانت النسخة الأولى من Voice Mode، التي أطلقتها OpenAI عام 2023، تعتمد على ثلاثة أنظمة منفصلة: تحويل كلام المستخدم إلى نص، وتوليد الإجابة بواسطة نموذج لغوي، ثم تحويلها إلى صوت. وقدمت الشركة لاحقًا Advanced Voice Mode باستخدام نموذج متعدد الوسائط بهدف تسريع المحادثات وتحسين طبيعتها، قبل أن يصبح GPT-Live الخيار الافتراضي بدلًا منه.

يعتمد GPT-Live على بنية تصفها OpenAI بأنها Full-Duplex، وتتيح للنموذج الاستماع والتحدث في الوقت نفسه. ويساعد ذلك على تقليل مقاطعة المستخدم عندما يتوقف لفترة قصيرة، ويجعل تبادل الحديث أقرب إلى المحادثات الطبيعية. ومن التغييرات التي يقدمها النموذج إصدار استجابات صوتية قصيرة خلال حديث المستخدم، مثل «ممم» أو «أجل».

ووفق المادة المصدرية، يستطيع GPT-Live الاستعانة في الخلفية بنماذج أكثر قدرة، مثل GPT-5.5، عندما يتطلب السؤال مزيدًا من التفكير أو البحث، مع استمرار المحادثة الصوتية من دون انقطاع واضح.

الفروق بين الخطط والميزات المتاحة

يحصل مشتركو ChatGPT Pro وPlus وGo على نموذج GPT-Live-1، في حين يستخدم أصحاب الخطة المجانية GPT-Live-1 mini. وبحسب التقرير، لا تتيح نسخة GPT-Live-1 mini تخصيص مستوى الذكاء، ما يجعل هذه الإمكانية مقتصرة على الخطط المدفوعة.

يمكن الاستفادة من سرعة استجابة GPT-Live في الترجمة خلال المحادثات المباشرة، كما يستطيع المستخدم التمرير إلى أسفل الشاشة للاطلاع على النص المكتوب لما يقوله الطرفان. وإذا رأى ChatGPT أن الإجابة تحتاج إلى عنصر بصري، فيمكنه إنشاء عنصر تفاعلي (Widget) إلى جانب الرد الصوتي للمساعدة في توضيحها.

لا يدعم GPT-Live حاليًا مشاركة الشاشة أو الفيديو. ومع ذلك، يستطيع المستخدم العودة إلى نموذج الصوت السابق من إعدادات ChatGPT، عبر الدخول إلى قسم Voice واختيار نموذج مختلف. ويتيح القسم نفسه تغيير صوت ChatGPT وتحديد اللغة، إلى جانب ضبط Voice Mode ليكون الوضع الافتراضي عند تشغيل التطبيق.