Cohere ha lanzado North Small Translate, un modelo de traducción automática basado en Mixture-of-Experts (MoE) disperso y de pesos abiertos, desarrollado junto con Cohere Labs y RWS. El modelo soporta 50 idiomas y obtiene una puntuación de 83.6 en el benchmark WMT26 para todos los idiomas.
- Arquitectura: 218B parámetros totales con 25B activos por token, utilizando un Transformer MoE disperso solo de decodificador con 128 expertos.
- Benchmarks: Obtiene 83.6 en general y 84.36 en un modo multi-paso agéntico, superando a DeepL NextGen (81.37) y Google Translate (68.20).
- Rendimiento: Alcanza 112 tokens de salida por segundo con baja concurrencia y maneja eficazmente documentos largos, obteniendo 48.9 en dos capítulos de libros.
- Despliegue: Disponible a través de la API de Cohere de forma gratuita hasta los límites de tasa, con opciones de autoalojamiento que incluyen checkpoints BF16, FP8 y NVFP4 W4A16 optimizados para hardware NVIDIA B200 y H100.
El modelo se posiciona como una alternativa rentable y de alto rendimiento para organizaciones que requieren capacidades precisas de comunicación global.