O modelo G9v3-39A5B está chamando a atenção por seu desempenho no artificialanalysis, onde reportedly fica acima do Qwen 3.6 27B.
- É uma arquitetura de Mixture of Experts (MoE).
- Existe um branch de recursos do llama.cpp para suportar o formato G9v3.
- Checkpoints GGUF estão disponíveis via Hugging Face.