Cohere는 Cohere Labs와 RWS와 함께 개발한 오픈 가중치 희소 전문가 혼합(MoE) 기계 번역 모델인 North Small Translate를 출시했습니다. 이 모델은 50개 언어를 지원하며, 모든 언어에 걸쳐 WMT26 벤치마크에서 83.6점을 기록했습니다.
- 아키텍처: 총 218B 파라미터와 토큰당 25B의 활성 파라미터를 가지며, 128개의 전문가를 사용하는 디코더 전용 희소 MoE 트랜스포머를 사용합니다.
- 벤치마크: 일반적으로 83.6점을 기록하고 에이전트식 다중 패스 모드에서 84.36점을 기록하여 DeepL NextGen(81.37)과 Google Translate(68.20)을 능가합니다.
- 성능: 낮은 동시성에서 초당 112개의 출력 토큰을 달성하고 긴 문서를 효과적으로 처리하며, 두 권의 책 챕터에서 48.9점을 기록했습니다.
- 배포: Cohere의 API를 통해 무료 제공(속도 제한까지)되며, NVIDIA B200 및 H100 하드웨어에 최적화된 BF16, FP8, NVFP4 W4A16 체크포인트를 포함한 자체 호스팅 옵션을 제공합니다.
이 모델은 정확한 글로벌 커뮤니케이션 기능이 필요한 조직을 위한 비용 효율적이고 높은 처리량을 가진 대안으로 포지셔닝됩니다.