Google a publié deux nouveaux modèles de parole à parole, Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking, qui sont similaires en structure aux modèles GPT-Live d'OpenAI.
- Le lancement inclut Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking.
- Une interface web permet aux utilisateurs de sélectionner un modèle et une voix prédéfinie, d'entrer un prompt système optionnel et de démarrer une conversation vocale via le navigateur.
- Les utilisateurs peuvent interrompre le modèle pendant qu'il parle, les transcriptions capturant ces interruptions.
- L'implémentation se connecte à un point de terminaison WebSocket et utilise l'API Web Audio pour la capture et la lecture sans bibliothèques externes.