Tema · Research paper
lab OpenAI News · há 22 d · 31 visualizações

Sistema interno da OpenAI prova que equações de Navier–Stokes podem desenvolver singularidades em tempo finito

A OpenAI relata que um sistema de IA interno produziu uma prova mostrando que a dinâmica das equações de Navier-Stokes para o movimento de fluidos pode desenvolver uma singularidade em tempo finito. A solução, derivada por um sistema multiagente alimentado por um modelo significativamente mais capaz que o GPT-6 Astra, estabelece a afirmação "C" da formulação do Prêmio Millennium.

lab Anthropic News · há 7 d · 40 visualizações

Claude da Anthropic descobre novo sistema de enzima ART em bacteriófagos

A Anthropic anunciou a criação de um novo grupo de pesquisa em ciências da vida dedicado a usar o Claude para identificar famílias de proteínas não caracterizadas e testar hipóteses por meio de experimentos laboratoriais. Nos resultados iniciais, a IA descobriu autonomamente um novo sistema enzimático chamado transcriptases reversas associadas a arrays (ART), encontrado em bacteriófagos.

lab Microsoft Research Blog · há 9 d · 62 visualizações

Microsoft lança RetroChimera para previsão de retrosíntese

A Microsoft Research publicou e disponibilizou como código aberto o RetroChimera, um novo framework para previsão de retrosíntese que combina dois modelos complementares para propor rotas de síntese de alta qualidade. O sistema integra R-SMILES 2, um modelo de-novo baseado em Transformer, com NeuralLoc, um modelo baseado em rede neural gráfica (GNN), utilizando uma estratégia de ensembling aprendida para classificar as previsões.

lab Google DeepMind Blog · há 27 d · 44 visualizações

Google DeepMind lança WeatherNext 3, um modelo de IA para previsão do tempo global com resolução de até 5 km

O Google DeepMind e o Google Research apresentaram o WeatherNext 3, um modelo avançado de IA para previsão do tempo global que gera previsões horárias em altas resoluções espaciais aprendendo diretamente de observações de satélite em tempo real. Esta atualização fornece previsões aproximadamente cinco vezes mais nítidas que seu antecessor, o WeatherNext 2, permitindo previsões mais localizadas para eventos climáticos críticos.

lab NVIDIA Research · há 16 d · 19 visualizações

Nvidia introduz modelos estendidos de erro de detector para compor erros de circuitos quânticos

O pesquisador da Nvidia N. Horrocks apresenta os modelos estendidos de erro de detector (EDEMs) projetados para lidar com programas quânticos tolerantes a falhas com circuitos estabilizadores e erros de Pauli estocásticos. Esses modelos permitem que a análise de erros seja composta em sequência e paralelo, espelhando a estrutura das realizações físicas do circuito.

media Latent Space · há 21 d · 29 visualizações

OpenAI afirma que resultado sobre singularidade de Navier-Stokes com assistência de IA usou 10.000 agentes

Contas afiliadas à OpenAI relataram que um esforço assistido por IA produziu um resultado relacionado ao problema da existência e regularidade de Navier-Stokes, um dos Problemas do Milênio. A alegação afirma que aproximadamente 10.000 agentes colaboraram na tarefa após serem treinados por cerca de um ano usando aprendizado por reforço multiagente.

arxiv arXiv cs.LG · há 28 d · 73 visualizações

Modelos Nemotron-3 da NVIDIA alcançam pontuação de ouro e recorde humano em IOI 2026

Pesquisadores desenvolveram um pipeline de pós-treinamento para modelos de linguagem grandes que permite alcançar desempenho de medalha de ouro em programação competitiva. Ao combinar ajuste fino supervisionado, aprendizado por reforço e uma nova estratégia orientada por feedback chamada GenCorrect, o sistema supera os melhores participantes humanos no conjunto de problemas do IOI 2026.

arxiv arXiv cs.CL · há 28 d · 35 visualizações

Modelos NVIDIA Nemotron-3 alcançam desempenho de medalha de ouro em competições de programação do IOI

A NVIDIA desenvolveu pipelines de pós-treinamento para seus modelos de linguagem Nemotron-3-Nano-CC e Nemotron-3-Ultra-CC para se destacarem na programação competitiva. Ao combinar a curadoria de problemas em larga escala, rastros de raciocínio sintéticos, ajuste fino supervisionado e aprendizado por reforço, a equipe criou sistemas especializados capazes de raciocínio algorítmico de alto nível.

arxiv arXiv cs.AI · há 28 d · 40 visualizações

Modelos Nemotron-3 da NVIDIA alcançam desempenho de medalha de ouro em competições de programação da IOI

A NVIDIA desenvolveu um pipeline de pós-treinamento para seus modelos de linguagem Nemotron-3, permitindo que eles alcancem desempenho de nível de medalha de ouro na Olimpíada Internacional de Informática (IOI). A abordagem combina curadoria em larga escala de problemas, rastros de raciocínio sintéticos, ajuste fino supervisionado e aprendizado por reforço.

arxiv arXiv cs.AI · há 1 d · 1 visualização

RareDx usa otimização de política baseada em grafos para melhorar o diagnóstico de doenças raras

Os autores apresentam o RareDx, um sistema que acopla o uso controlado de evidências com otimização de política fundamentada em grafos de conhecimento para abordar o problema de raciocínio de cauda longa no diagnóstico de doenças raras. O pipeline de treinamento combina Top-10 pós-treinamento com RareDx-KGPO, que projeta previsões em um grafo canônico de doenças e integra relevância graduada curada, proximidade ontológica, similaridade biomédica e consistência fenotípica.

arxiv arXiv cs.AI · há 2 d · 3 visualizações

TokenProbe reduz o uso de tokens no CoT em 76% enquanto preserva a qualidade do raciocínio

Pesquisadores apresentam o TokenProbe, uma estrutura que aborda o alto consumo de tokens do raciocínio em cadeia (Chain-of-Thought) explorando o valor não uniforme dos tokens dentro de uma sequência. O método usa probabilidade logarítmica normalizada para distinguir tokens estruturais centrais de preenchimento redundante, permitindo compressão seletiva.

arxiv arXiv cs.CL · há 2 d · 1 visualização

Rep2Act alinha representações de VLM para melhorar a abstenção no novo benchmark VAD-R

Pesquisadores introduzem o Diagnóstico de Responsividade Visual com Raciocínios (VAD-R), um novo benchmark projetado para avaliar a capacidade dos modelos de visão e linguagem de se absterem de perguntas sem resposta sem usar atalhos. O estudo revela que, embora os estados ocultos possam distinguir a responsividade, os modelos atuais falham em traduzir isso em decisões explícitas.

arxiv arXiv cs.AI · há 3 d · 15 visualizações

Highlight-Then-Summarize comprime evidências para melhorar a compreensão de contexto longo

Pesquisadores propõem o Highlight-Then-Summarize (H2S), um paradigma de compressão seguida de raciocínio que identifica evidências relevantes à pergunta e as integra em um resumo compacto antes de gerar uma resposta. A equipe constrói o H2S-Dataset com 6.647 exemplos e introduz o H2S-RL para fornecer recompensas em nível de processo para a seleção de evidências.

arxiv arXiv cs.CL · há 3 d · 6 visualizações

Highlight-Then-Summarize comprime evidências para melhor compreensão de contexto longo

Pesquisadores propõem o Highlight-Then-Summarize (H2S), um paradigma de compressão-então-raciocínio que identifica evidências relevantes à pergunta e as integra em um resumo compacto antes de gerar uma resposta. Para apoiar essa abordagem, a equipe construiu o H2S-Dataset com 6.647 exemplos de 11 famílias de benchmarks e introduziu o H2S-RL para recompensas em nível de processo.

media Hugging Face Forums · há 3 d · 4 visualizações

Hung Tran identifica armadilha de clippagem em codecs neurais de imagem superajustados

Hung Tran, estudante de mestrado da Universidade de Tecnologia da Informação (VNU-HCM), publicou código e dados para seu artigo "The Clipping Trap: A Silent Failure Mode in Overfitted Neural Image Codecs." O trabalho destaca como codecs superajustados, como Cool-chic e C3, podem produzir imagens com cores planas e gradientes de distorção zero em tipos específicos de conteúdo.