Um relatório que analisa dados do Hugging Face Hub no início de 2026 revela que laboratórios chineses superaram os americanos em tamanho de modelos abertos de fronteira, enquanto fornecedores de hardware como NVIDIA e AMD dominam os lançamentos de novos repositórios. A análise destaca uma divergência entre a empolgação da comunidade (curtidas) e a adoção real (downloads), com modelos pequenos permanecendo o padrão prático para inferência local.
- Laboratórios chineses lançaram modelos mensais de teto variando de 754B a 2,78 trilhões de parâmetros, enquanto os tetos dos EUA permaneceram abaixo de 130B em cinco dos sete meses.
- NVIDIA e AMD lançaram cada uma mais de 200 novos repositórios de modelos, muito à frente de outras organizações, usando modelos abertos para demonstrar capacidades de hardware.
- Qwen tornou-se o modelo base do ecossistema com 151.448 derivados no Hub, superando significativamente a presença da Llama da Meta.
- Modelos com menos de 1B de parâmetros representam 83% de todos os downloads históricos, enquanto aqueles acima de 100B respondem por apenas 1%, impulsionados por ferramentas de inferência local como llama.cpp.
- Laboratórios chineses licenciaram modelos grandes de forma permissiva, com 59% usando Apache 2.0 e 22% MIT, evitando restrições não comerciais para impulsionar o crescimento da API e do ecossistema.
Os dados sugerem que o valor do código aberto mudou da receita de licenciamento de modelos para posicionamento de hardware e domínio do ecossistema, com camadas de quantização permitindo a viabilidade de estratégias de lançamento focadas em fronteira.