A Mistral lançou o Mistral Large 2, um novo modelo de linguagem grande com 123 bilhões de parâmetros, projetado para inferência em nó único com alta vazão. O modelo suporta uma janela de contexto de 128k e dezenas de idiomas, ao mesmo tempo que oferece desempenho aprimorado em codificação, raciocínio e seguimento de instruções.

  • A versão pré-treinada alcança 84,0% de precisão no MMLU, estabelecendo um novo ponto na fronteira de Pareto entre desempenho e custo para modelos abertos.
  • Desempenha-se em nível equivalente a modelos líderes como GPT-4o, Claude 3 Opus e Llama 3 405B em tarefas de codificação e raciocínio.
  • O modelo é treinado para minimizar alucinações e reconhecer quando não possui informações suficientes para respostas confiantes.
  • Os pesos estão disponíveis sob a Licença de Pesquisa da Mistral para uso de pesquisa e não comercial, sendo necessária uma licença separada para autoimplantação comercial.

O lançamento visa fornecer uma alternativa com baixo custo para o desenvolvimento de aplicações inovadoras de IA, estando disponível na la Plateforme, HuggingFace e nos principais provedores de nuvem, incluindo Google Cloud Platform, Azure, Amazon Bedrock e IBM watsonx.ai.