Un nuevo envoltorio de implementación sin dependencias llamado F-0310 permite la inferencia completamente local y sin conexión para Coqui XTTS-v2 y Qwen 2.5 en Windows sin requerir APIs en la nube.
La configuración integra Qwen 2.5 para ejecutar barreras de seguridad locales antes de pasar los prompts al motor de síntesis de voz. Utiliza Coqui XTTS-v2 para clonación de voz zero-shot de alta fidelidad e incluye scripts .bat automatizados para la configuración del entorno. La herramienta detecta dinámicamente el hardware para cambiar los backends de ejecución entre NVIDIA CUDA, AMD DirectML, Intel Iris/Arc o fallback a CPU.
Esta solución permite a los usuarios ejecutar pipelines multimodales complejos localmente en Windows con adaptación automática de hardware.