ByteDance Seed presenta SeedRealtime, un LLM nativo de audio y video full-dúplex
El equipo Seed de ByteDance ha presentado SeedRealtime, un modelo de lenguaje grande nativo de audio y video full-dúplex que fusiona audio, video y texto en una única arquitectura unificada. A diferencia de las pilas en cascada tradicionales de módulos ASR, VLM y TTS, SeedRealtime ejecuta la percepción, la comprensión, la toma de decisiones y la expresión en paralelo para permitir interacciones en tiempo real sobre flujos multimodales continuos.