Mistral ha lanzado Mistral Large 2, un nuevo modelo de lenguaje grande que cuenta con 123 mil millones de parámetros y está diseñado para inferencia en un solo nodo de alto rendimiento. El modelo admite una ventana de contexto de 128k y decenas de idiomas, al tiempo que ofrece un rendimiento mejorado en codificación, razonamiento y seguimiento de instrucciones.
- La versión preentrenada alcanza una precisión del 84.0% en MMLU, estableciendo un nuevo punto en la frontera Pareto de rendimiento/costo para modelos abiertos.
- Rinde a la par que modelos líderes como GPT-4o, Claude 3 Opus y Llama 3 405B en tareas de codificación y razonamiento.
- El modelo está entrenado para minimizar alucinaciones y reconocer cuándo carece de información suficiente para dar respuestas confiables.
- Los pesos están disponibles bajo la Licencia de Investigación de Mistral para investigación y uso no comercial, requiriéndose una licencia separada para el despliegue comercial auto-gestionado.
El lanzamiento tiene como objetivo proporcionar una alternativa eficiente en costos para construir aplicaciones innovadoras de IA, con disponibilidad en la Plataforma, HuggingFace y los principales proveedores de nube incluyendo Google Cloud Platform, Azure, Amazon Bedrock e IBM watsonx.ai.