بايت دانس سيد تطرح SeedRealtime، نموذج لغوي كبير ثنائي الاتجاه أصلي للصوت والمرئيات
أطلق فريق بايت دانس سيد نموذج SeedRealtime، وهو نموذج لغوي كبير أصلي للصوت والمرئيات يعمل بنظام ثنائي الاتجاه، يدمج الصوت والفيديو والنص في بنية موحدة واحدة. وعلى عكس الطبقات المتسلسلة التقليدية لمكونات التعرف على الكلام (ASR)، وفهم الصور (VLM)، وتوليف الكلام (TTS)، يعمل SeedRealtime على الإدراك والفهم واتخاذ القرار والتعبير بالتوازي لتمكين التفاعل في الوقت الفعلي عبر تدفقات متعددة الوسائط بشكل مستمر.