Модель G9v3-39A5B привлекает внимание благодаря своей производительности на artificialanalysis, где она, по сообщениям, занимает позицию выше Qwen 3.6 27B.
- Это архитектура Mixture of Experts (MoE).
- Существует ветка функций llama.cpp для поддержки формата G9v3.
- Контрольные точки GGUF доступны через Hugging Face.