Google ha lanzado dos nuevos modelos de voz a voz, Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking, que son similares en estructura a los modelos GPT-Live de OpenAI.
- El lanzamiento incluye Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking.
- Una interfaz web permite a los usuarios seleccionar un modelo y una voz preestablecida, ingresar un prompt del sistema opcional e iniciar una conversación por voz a través del navegador.
- Los usuarios pueden interrumpir al modelo mientras está hablando, con las transcripciones capturando estas interrupciones.
- La implementación se conecta a un punto final WebSocket y utiliza la API Web Audio para la captura y reproducción sin bibliotecas externas.