Mistral telah merilis Mistral Large 2, model bahasa besar baru yang memiliki 123 miliar parameter dan dirancang untuk inferensi single-node ber-throughput tinggi. Model ini mendukung jendela konteks 128k dan puluhan bahasa sambil menawarkan kinerja yang lebih baik dalam pemrograman, penalaran, dan kepatuhan terhadap instruksi.
- Versi pretrained mencapai akurasi 84.0% pada MMLU, menetapkan titik baru pada front Pareto kinerja/kost untuk model open-source.
- Model ini berkinerja setara dengan model terkemuka seperti GPT-4o, Claude 3 Opus, dan Llama 3 405B dalam tugas pemrograman dan penalaran.
- Model ini dilatih untuk meminimalkan halusinasi dan mengakui ketika ia tidak memiliki informasi yang cukup untuk memberikan jawaban yang percaya diri.
- Bobot tersedia di bawah Lisensi Penelitian Mistral untuk penelitian dan penggunaan non-komersial, dengan penyebaran mandiri komersial memerlukan lisensi terpisah.
Rilis ini bertujuan untuk menyediakan alternatif yang hemat biaya dalam membangun aplikasi AI inovatif, dengan ketersediaan di la Plateforme, HuggingFace, dan penyedia cloud utama termasuk Google Cloud Platform, Azure, Amazon Bedrock, dan IBM watsonx.ai.