Cohere выпустила North Small Translate, открытую модель машинного перевода с разреженной смесью экспертов (MoE), разработанную совместно с Cohere Labs и RWS. Модель поддерживает 50 языков и набирает 83.6 балла на бенчмарке WMT26 по всем языкам.
- Архитектура: 218B общих параметров, из которых 25B активны на токен; используется декодерный разреженный MoE Transformer с 128 экспертами.
- Бенчмарки: набирает 83.6 в общем режиме и 84.36 в агентном многопроходном режиме, превосходя DeepL NextGen (81.37) и Google Translate (68.20).
- Производительность: достигает 112 выходных токенов в секунду при низкой конкурентности и эффективно обрабатывает длинные документы, набирая 48.9 на двух главах книги.
- Развертывание: доступно через API Cohere бесплатно до достижения лимитов скорости; есть варианты самостоятельного размещения с чекпоинтами BF16, FP8 и NVFP4 W4A16, оптимизированными для оборудования NVIDIA B200 и H100.
Модель позиционируется как экономически эффективная альтернатива с высокой пропускной способностью для организаций, нуждающихся в точных возможностях глобальной коммуникации.