Cohere telah merilis North Small Translate, sebuah model terjemahan mesin sparse Mixture-of-Experts (MoE) dengan bobot terbuka yang dikembangkan bersama Cohere Labs dan RWS. Model ini mendukung 50 bahasa dan meraih skor 83.6 pada benchmark WMT26 di seluruh bahasa.

  • Arsitektur: Total 218B parameter dengan 25B aktif per token, menggunakan Transformer sparse MoE decoder-only dengan 128 ahli.
  • Benchmark: Meraih skor 83.6 secara umum dan 84.36 dalam mode multi-pass agentic, melampaui DeepL NextGen (81.37) dan Google Translate (68.20).
  • Kinerja: Mencapai 112 token keluaran per detik pada konkurensi rendah dan menangani dokumen panjang secara efektif, meraih skor 48.9 pada dua bab buku.
  • Deployment: Tersedia melalui API Cohere secara gratis hingga batas laju, dengan opsi self-hosting termasuk checkpoint BF16, FP8, dan NVFP4 W4A16 yang dioptimalkan untuk perangkat keras NVIDIA B200 dan H100.

Model ini diposisikan sebagai alternatif hemat biaya dan ber-throughput tinggi bagi organisasi yang membutuhkan kemampuan komunikasi global yang akurat.