أطلقت جوجل نموذجين جديدين لتحويل الكلام إلى كلام، هما Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking، وهما متشابهان في الشكل مع نماذج GPT-Live من OpenAI.

  • يتضمن الإصدار Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking.
  • تتيح واجهة الويب للمستخدمين اختيار نموذج وصوت مسبق الضبط، وإدخال موجه نظام اختياري، وبدء محادثة صوتية عبر المتصفح.
  • يمكن للمستخدمين مقاطعة النموذج أثناء كلامه، حيث تسجل النصوص هذه المقاطعات.
  • يتصل التنفيذ بنقطة نهاية WebSocket ويستخدم Web Audio API للتقاط وتشغيل الصوت دون مكتبات خارجية.