Mistral выпустила Mistral Large 2, новую большую языковую модель с 123 миллиардами параметров, предназначенную для высокопроизводительного инференса на одном узле. Модель поддерживает контекстное окно размером 128k и десятки языков, обеспечивая улучшенные показатели в задачах программирования, рассуждений и следования инструкциям.

  • Предобученная версия достигает точности 84.0% на MMLU, устанавливая новую точку на границе Парето производительности/стоимости для открытых моделей.
  • Она показывает результаты на уровне ведущих моделей, таких как GPT-4o, Claude 3 Opus и Llama 3 405B в задачах программирования и рассуждений.
  • Модель обучена минимизировать галлюцинации и признавать отсутствие достаточной информации для уверенных ответов.
  • Веса доступны по лицензии Mistral Research License для исследовательских и некоммерческих целей, коммерческое самостоятельное развертывание требует отдельной лицензии.

Выпуск направлен на предоставление экономичной альтернативы для создания инновационных ИИ-приложений; модель доступна на la Plateforme, HuggingFace, а также у основных облачных провайдеров, включая Google Cloud Platform, Azure, Amazon Bedrock и IBM watsonx.ai.