أطلقت جوجل نموذجين جديدين لتحويل الكلام إلى كلام، هما Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking، وهما متشابهان في الشكل مع نماذج GPT-Live من OpenAI.
- يتضمن الإصدار Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking.
- تتيح واجهة الويب للمستخدمين اختيار نموذج وصوت مسبق الضبط، وإدخال موجه نظام اختياري، وبدء محادثة صوتية عبر المتصفح.
- يمكن للمستخدمين مقاطعة النموذج أثناء كلامه، حيث تسجل النصوص هذه المقاطعات.
- يتصل التنفيذ بنقطة نهاية WebSocket ويستخدم Web Audio API للتقاط وتشغيل الصوت دون مكتبات خارجية.