Tema · AI agents
lab OpenAI News · há 1 d BrowseComp · 84.36% · 8 visualizações

OpenAI lança GPT-5.6 para fluxos de trabalho agênticos acessíveis e de alto desempenho

A OpenAI lançou a família de modelos GPT-5.6, projetada para entregar desempenho de agente de nível fronteira com custos significativamente menores, otimizando o esforço de raciocínio e introduzindo novos controles de API. A atualização permite que startups construam agentes mais rápidos e capazes usando modelos menores como Luna e Terra para tarefas de alto volume, enquanto reservam modelos maiores para julgamentos complexos.

lab OpenAI News · há 14 d · 23 visualizações

Modelo Astra resolve dez problemas abertos em matemática e ciência da computação teórica

O modelo interno Astra da OpenAI gerou soluções para dez problemas abertos de longa data em matemática e ciência da computação teórica, com os argumentos formalizados em Lean. Esses resultados abrangem geometria de alta dimensão, teoria dos códigos, teoria dos grupos e complexidade quântica, abordando questões que não tinham avanços há pelo menos uma década.

lab Google DeepMind Blog · há 15 d · 8 visualizações

Google apresenta Gemini Robotics 2 para controle de corpo inteiro e colaboração entre múltiplos robôs

A Google introduziu o Gemini Robotics 2, uma camada de inteligência projetada para fornecer a robôs adaptáveis um controle inteligente de corpo inteiro, destreza avançada e capacidade de colaborar em equipes. Esta atualização expande as capacidades da IA física além de tarefas estreitas e repetitivas, permitindo que os robôs raciocinem sobre movimentos e se adaptem rapidamente a novos corpos.

lab Google — The Keyword (AI) · há 3 d · 40 visualizações

Google demonstra capacidades de consulta clínica por vídeo em tempo real com o AMIE

O Google Research e o Google DeepMind avançaram sua pesquisa no sistema de IA médica AMIE para demonstrar capacidades de consulta clínica por vídeo em tempo real em um estudo inédito. Construído sobre Gemini e Project Astra usando uma arquitetura multiagente, o sistema interpreta sinais visuais e auditivos, orienta exames físicos virtuais e raciocina diagnosticamente em tempo real.

lab xAI News · há 3 d · 42 visualizações

xAI lança Grok Bot, agentes de IA sempre ativos para desktop e iOS

A xAI lançou o Grok Bot em beta, introduzindo um sistema de agentes de IA sempre ativos que operam em seu próprio computador na nuvem para lidar com tarefas de ponta a ponta. Disponível hoje para assinantes do SuperGrok Heavy, Cursor Ultra e Cursor Teams Premium no desktop e iOS, os bots funcionam entre aplicativos e ferramentas sem exigir configuração manual de fluxos de trabalho.

lab OpenAI News · há 7 d · 10 visualizações

Anthropic pausa o desenvolvimento do Astra após avaliações internas sugerirem capacidades cibernéticas críticas

A Anthropic pausou as atividades internas envolvendo seu próximo modelo, o Astra, porque avaliações recentes indicam que ele pode possuir capacidades críticas de cibersegurança sob o Framework de Preparação da empresa. A firma não pode descartar que o modelo possa identificar e desenvolver exploits funcionais de dia zero em sistemas reais endurecidos sem intervenção humana.

lab OpenAI News · há 11 d · 15 visualizações

Engenheiros da OpenAI desenvolvem GPT-Live, um sistema de voz full-duplex que remove detectores de turno

A OpenAI lançou o GPT-Live, um sistema de voz de terceira geração que elimina o detector de turno tradicional ao usar um modelo full-duplex capaz de ouvir e falar simultaneamente. Essa arquitetura permite conversas mais imediatas e naturais, mantendo baixa latência por meio de um novo design de sistema otimizado para desempenho em tempo real.

lab Microsoft Research Blog · há 11 d SWE-bench Verified · 69.7% · 15 visualizações

Microsoft Research lança o framework Orchard para IA agente escalável

A Microsoft Research lançou o Orchard, um framework de código aberto projetado para permitir pesquisas escaláveis e com custo-benefício sobre agentes autônomos. O sistema tem como base o Orchard Env, um serviço de ambiente baseado em Kubernetes que permite aos pesquisadores treinar e avaliar agentes em diversos domínios, como engenharia de software, navegação na web e assistência pessoal, sem a necessidade de reconstruir a infraestrutura.

lab Google DeepMind Blog · há 15 d · 13 visualizações

Google lança o Gemini Robotics ER 2 com compreensão de vídeo e colaboração entre múltiplos robôs

A Google lançou o Gemini Robotics ER 2, um novo modelo de raciocínio corporificado projetado para ajudar os robôs a pensar rápido e planejar tarefas em múltiplos passos em tempo real. A atualização traz melhorias significativas em relação à versão anterior ER 1.6, incluindo rastreamento contínuo do progresso com base em vídeo, localização precisa de momentos-chave e capacidades nativas de colaboração entre múltiplos robôs.