Recente
776 →
Google lança o modelo Gemini 4 Argon
Trump assina Acordo da Casa Branca sobre IA com líderes de tecnologia
Claude Code v2.1.286 corrige problemas de autenticação, MCP e subagentes
+773 mais
Inference efficiency
272 →
llama.cpp b11284 corrige GET_ROWS do OpenVINO em visualizações de pesos quantizados
Lançamento do llama.cpp b11280 reduz sincronização allreduce de tensores com buffers host fixados
llama.cpp b11282 define CUDA_ARCH para passes de dispositivo MUSA
+269 mais
AI agents
228 →
Claude Code v2.1.286 corrige problemas de autenticação, MCP e subagentes
OpenAI apresenta agentes Dots, GPT-6.1 Sol e API de Decisões
AutoGPT Platform v0.8.2 adiciona modos de gateamento AutoPilot e novos LLMs
+225 mais
API & product launches
127 →
Google lança o modelo Gemini 4 Argon
OpenAI apresenta agentes Dots, GPT-6.1 Sol e API de Decisões
Anthropic e OpenAI lançam modelos mais baratos; OpenAI divulga nove incidentes de desalinhamento
+124 mais
Safety & alignment
101 →
OpenAI interrompe campanha ligada à Moonshot AI que extrai raciocínio protegido
Anthropic e OpenAI lançam modelos mais baratos; OpenAI divulga nove incidentes de desalinhamento
Google DeepMind apresenta SynthID Bio para marcar com marca d'água proteínas geradas por IA
+98 mais
Local inference
95 →
llama.cpp b11284 corrige GET_ROWS do OpenVINO em visualizações de pesos quantizados
llama.cpp adiciona suporte para GLM-5.3-Flash com correções de k-pool e MTP
llama.cpp b11272 otimiza operação de concatenação Hexagon
+92 mais
Open weights
77 →
Google DeepMind apresenta SynthID Bio para marcar com marca d'água proteínas geradas por IA
NVIDIA lança o modelo base Kumo Tabular para previsão tabular zero-shot
H Company lança modelos de uso de computador Holo4 de peso aberto para desktop, web e mobile
+74 mais
Code generation
75 →
Claude Code v2.1.286 corrige problemas de autenticação, MCP e subagentes
AutoGPT Platform v0.8.2 adiciona modos de gateamento AutoPilot e novos LLMs
OpenAI apresenta GPT-6.1 Sol para codificação agêntica por um quinto do custo do Astra
+72 mais
Research paper
60 →
Raciocínio meta-agêntico escala a inferência através de controle explícito
RareDx usa otimização de política baseada em grafos para melhorar o diagnóstico de doenças raras
TokenProbe reduz o uso de tokens no CoT em 76% enquanto preserva a qualidade do raciocínio
+57 mais
Benchmark results
43 →
Pesquisadores da NVIDIA lançam Physis-Lang para melhorar o raciocínio físico nos modelos de vídeo Cosmos 3
Radar de Computação em IA classifica Qwen da Alibaba e Google como principais laboratórios de modelos abertos por Pontuação de Calor
Anthropic descobre que GLM-5.3 alcança sequestros completos de fluxo de controle em ciberred teaming
+40 mais
Evaluation & benchmarks
41 →
Leaderboard Open TTS lança avaliação escalável de TTS multilíngue
Pesquisador independente avalia o Kavach contra os 42 ataques de injeção de prompt reais do IssueTrojanBench
Estudo revela divergência de política epistêmica na contaminação de LLMs multi-turno
+38 mais
Training methods
33 →
Modelos de Linguagem Contextual gerenciam contexto nativamente como arquivos editáveis
ROFT melhora modelos agênticos ajustando-os em explicações autogeradas
Pesquisador busca experiência industrial com desafios de engenharia de destilação de conhecimento
+30 mais
Hardware & chips
32 →
Lançamento do llama.cpp b11280 reduz sincronização allreduce de tensores com buffers host fixados
DeepSeek agora treina modelos no Ascend 950
AI Hardware Fit conecta os requisitos de VRAM do modelo à seleção de GPU
+29 mais
Retrieval & RAG
31 →
Cohere lança modelos de embedding Embed 5 Pro e Fast
Perplexity lança Photon, reduzindo latência p99 de recuperação de 800 ms para 65 ms
ProvenanceGuard adiciona verificação consciente da fonte a agentes MCP
+28 mais
Multimodal
28 →
Microsoft Research apresenta Quine, um sistema de IA para pesquisa biológica multimodal
llama.cpp b11240 adiciona suporte a entrada multimodal tipada para /v1/embeddings
Graduando propõe mudanças arquiteturais no Qwen 2.5 Omni 3B para impedir interferência visual
+25 mais
Voice & audio
28 →
Leaderboard Open TTS lança avaliação escalável de TTS multilíngue
Alibaba Qwen lança modelo de voz full-duplex Qwen-Audio-3.1-Realtime
llama.cpp b11190 corrige o pré-processador mel no LFM2 audio
+25 mais
Policy & regulation
21 →
Trump assina Acordo da Casa Branca sobre IA com líderes de tecnologia
OpenAI cancela lançamento do Astra 6.1 devido a falhas de alinhamento
Instituto Lenfest amplia bolsa de estudos em IA com US$ 5 milhões da OpenAI
+18 mais
Image generation
14 →
AutoRef otimiza o arnés de agentes para geração de imagens com múltiplas referências
Hung Tran identifica armadilha de clippagem em codecs neurais de imagem superajustados
Meta abre conectores do Muse, lança SAM 3.1 e Gemini hackeia sistemas
+11 mais
Video generation
13 →
Pesquisadores da NVIDIA lançam Physis-Lang para melhorar o raciocínio físico nos modelos de vídeo Cosmos 3
Google Research apresenta 4 estruturas agênticas para geração de vídeos coerentes com duração de minutos
Runway apresenta o WorldPrompt para geração de mundos interativos em tempo real
+10 mais
Reasoning models
11 →
TokenProbe reduz o uso de tokens CoT em 76% enquanto preserva a precisão
TelecomGPT-R1: Pós-treinamento unificado para raciocínio em tarefas de telecomunicações heterogêneas
CosmicUndercurrent lança Principia-Structurae-Realitatis para testar coordenação de todo o sistema em LLMs
+8 mais
Robotics
7 →
AMD compra World Labs por $8,2B enquanto Atlas resolve reconstrução esparsa
Black Forest Labs lança FLUX 3 Action, um Modelo de Ação Mundial (World Action Model) de pesos abertos com 7B
Shanghai AI Lab lança o modelo de mundo físico InternW0 para interações eficientes no mundo real
+4 mais