Recente
788 →
Modelos de IA da Alibaba superam Meta e Google com 3 bilhões de downloads no Hugging Face
llama.cpp b10437 adiciona suporte para os modelos MiniMax-Text-01 e MiniMax-M1
SDK Python da OpenAI v0.21.0 adiciona APIs de teste neutras em relação ao provedor e compatibilidade com OpenAI v3
+785 mais
AI agents
246 →
SDK Python da OpenAI v0.21.0 adiciona APIs de teste neutras em relação ao provedor e compatibilidade com OpenAI v3
Claude Code v2.1.233 adiciona suporte a MR do GitLab, limites de memória e desativa ferramentas de tarefas em novos modelos
OpenAI previewa modo Ultrafast do GPT-5.6 Sol; Google lança Gemini 3.7 Flash
+243 mais
Inference efficiency
180 →
llama.cpp b10437 adiciona suporte para os modelos MiniMax-Text-01 e MiniMax-M1
llama.cpp b10435 corrige custo quadrático no jinja gather_string_parts
llama.cpp b10434 passa reasoning_effort para templates
+177 mais
Open weights
166 →
Modelos de IA da Alibaba superam Meta e Google com 3 bilhões de downloads no Hugging Face
Z.ai lança GLM-5.3 com pós-treinamento estendido
Estado dos Modelos Abertos: Observações do Verão de 2026
+163 mais
API & product launches
114 →
SDK Python da OpenAI v0.21.0 adiciona APIs de teste neutras em relação ao provedor e compatibilidade com OpenAI v3
xAI lança modelo de codificação Grok 4.6 no GitHub Copilot
OpenAI previewa modo Ultrafast do GPT-5.6 Sol; Google lança Gemini 3.7 Flash
+111 mais
Code generation
94 →
Claude Code v2.1.233 adiciona suporte a MR do GitLab, limites de memória e desativa ferramentas de tarefas em novos modelos
xAI lança modelo de codificação Grok 4.6 no GitHub Copilot
Meta lança o framework agético Muse Code e o modelo de baixo custo Muse Spark 1.2
+91 mais
Safety & alignment
76 →
Claude implementa marca d'água SynthID-Text para conformidade com a Lei de IA da UE
Muse-Ltd submete o benchmark UncertaintyGym para calibração epistêmica de LLMs
Agentes da OpenAI atacaram acidentalmente o Hugging Face via Artifactory
+73 mais
Research paper
74 →
HorizonRelight usa autocondicionamento mascarado para relighting consistente de vídeo em longo prazo
Faraday 27B supera Claude Opus 4.8 e GPT-5.5 em tarefas de replicação de artigos
Faraday 27B supera Claude Opus 4.8 e GPT-5.5 em tarefas de replicação de artigos
+71 mais
Benchmark results
58 →
Modelos de IA da Alibaba superam Meta e Google com 3 bilhões de downloads no Hugging Face
Z.ai lança GLM-5.3 com pós-treinamento estendido
Qwen lança o modelo Qwen3.8-27B no ModelScope e Hugging Face
+55 mais
Local inference
51 →
llama.cpp b10434 passa reasoning_effort para templates
Estado dos Modelos Abertos: Observações do Verão de 2026
llama.cpp b10418 adiciona suporte a memória fixa do host para SYCL
+48 mais
Training methods
41 →
ThetaMem propõe elevações multiplicativas com sinal para memória de sequência de estado fixo
Dyna Robotics lança Dyna-2, um modelo de ação no mundo pré-treinado em 1 milhão de horas de vídeo humano
LLMs igualam ou superam a otimização bayesiana para otimização de hiperparâmetros
+38 mais
Multimodal
40 →
Intern-S2-Preview: Modelo de Base Agênico Científico
dots-studio lança preview do dots3-note, um modelo MoE de 280B
Liquid AI lança LFM2.5-VL-3B, um modelo de visão e linguagem de 3B para dispositivos móveis com chamada de ferramentas
+37 mais
Policy & regulation
37 →
Claude implementa marca d'água SynthID-Text para conformidade com a Lei de IA da UE
Casa Branca expandirá política de IA, potencialmente adicionando modelos abertos
Anthropic, OpenAI, Google, Meta, Microsoft e Mistral assinam código de transparência de IA da UE
+34 mais
Evaluation & benchmarks
33 →
Lições na construção de sistemas agênticos de produção
Muse-Ltd submete o benchmark UncertaintyGym para calibração epistêmica de LLMs
Desafio de Reproduções Abertas do ICML 2026 revela que 23% dos artigos examinados têm afirmações falsificadas
+30 mais
Hardware & chips
20 →
Alibaba libera pesos abertos do Qwen3.8-2.4T-A95B para NVIDIA GB300 NVL72
RunSnack permite compartilhamento de GPU P2P via um único link
llama.cpp b10306 adiciona caminho plano de GLU SYCL e consolida kernels
+17 mais
Robotics
19 →
Strands Agents integra LeRobot e Hugging Face Storage Buckets para loops contínuos de dados de robôs
Dyna Robotics lança Dyna-2, um modelo de ação no mundo pré-treinado em 1 milhão de horas de vídeo humano
Calibra detecta problemas em conjuntos de dados de aprendizado robótico
+16 mais
Retrieval & RAG
16 →
RAG clínico VITA iguala ou supera LLMs de ponta no HealthBench
VITA RAG específico do corpus iguala ou supera LLMs de ponta no HealthBench
Sistema RAG clínico VITA iguala ou supera LLMs de ponta no HealthBench
+13 mais
Video generation
15 →
HorizonRelight usa autocondicionamento mascarado para relighting consistente de vídeo em longo prazo
LTX lança LTX-2.5, um modelo de mundo com pesos abertos para geração local de vídeo
MiniMax lança modelo de vídeo H3 de pesos abertos com áudio sincronizado
+12 mais
Voice & audio
13 →
llama.cpp b10369 adiciona suporte ao pocket-tts com geração CUDA 80% mais rápida
NVIDIA Magpie TTS adiciona árabe, coreano e português e melhora a qualidade
NVIDIA lança NemotronLabs VoiceChat 11B, um modelo de fala-para-fala full-duplex aberto com troca de turno em ~450 ms
+10 mais
Reasoning models
13 →
Pesquisadores roubam rastros de raciocínio de APIs de LLM proprietárias por meio de ataques de replay
Pesquisadores decodificam rastros de raciocínio criptografados das APIs Claude, GPT e Gemini
Pesquisadores exploram reutilização de criptografia entre sessões para roubar rastros de raciocínio de APIs de LLM
+10 mais