Mistralは、高スループットの単一ノード推論向けに設計された1230億パラメータを備えた新しい大規模言語モデル「Mistral Large 2」をリリースしました。このモデルは128kのコンテキストウィンドウをサポートし、数十の言語に対応しながら、コーディング、推論、指示追従においてパフォーマンスを向上させています。

  • プリトレーニング版はMMLUで84.0%の精度を達成し、オープンモデルのパフォーマンス/コストのパレート最適 frontier に新たなポイントを設定しました。
  • コードおよび推論タスクにおいて、GPT-4o、Claude 3 Opus、Llama 3 405B などの主要モデルと同等のパフォーマンスを発揮します。
  • このモデルは幻覚を最小限に抑え、自信のある回答に必要な情報が不足している場合はそれを明示するよう訓練されています。
  • 重みは研究および非商用利用のためにMistral Research Licenseの下で公開されており、商用の自己デプロイには別途ライセンスが必要です。

今回のリリースは、革新的なAIアプリケーションを構築するためのコスト効率の良い代替手段を提供することを目的としており、la Plateforme、HuggingFace、Google Cloud Platform、Azure、Amazon Bedrock、IBM watsonx.ai を含む主要なクラウドプロバイダーで利用可能です。