O modelo G9v3-39A5B está chamando a atenção por seu desempenho no artificialanalysis, onde reportedly fica acima do Qwen 3.6 27B.

  • É uma arquitetura de Mixture of Experts (MoE).
  • Existe um branch de recursos do llama.cpp para suportar o formato G9v3.
  • Checkpoints GGUF estão disponíveis via Hugging Face.