Модель G9v3-39A5B привлекает внимание благодаря своей производительности на artificialanalysis, где она, по сообщениям, занимает позицию выше Qwen 3.6 27B.

  • Это архитектура Mixture of Experts (MoE).
  • Существует ветка функций llama.cpp для поддержки формата G9v3.
  • Контрольные точки GGUF доступны через Hugging Face.