O GPT-5.5 Instant melhora as respostas de saúde e bem-estar do ChatGPT por meio de raciocínio mais forte, melhor manejo de contexto, comunicação mais clara e avaliações informadas por médicos.
GPT-5.5 Instant melhora as respostas de saúde do ChatGPT
Sistema Buddy: Monitor de entropia Rust com incerteza gated por NER para inferência LLM em camadas
O Sistema Buddy usa um monitor de entropia Rust para detectar a incerteza por token na inferência local do Gemma 3 4B, roteando apenas tokens incertos para o Sonnet por meio de extração de span com gate NER e recuperação semântica. Os benchmarks mostram que ele alcança 71,4% de precisão por $0,21, superando o padrão Anthropic Advisor (62,9% por $0,44) em sete conjuntos de dados do Hugging Face, com uma melhoria chave no SQuAD v2 ao rotear trechos de passagem de origem para o modelo na nuvem.
Anthropic lança Claude Opus 4 e Sonnet 4 com raciocínio híbrido
A Anthropic lançou dois novos modelos de linguagem grandes, Claude Opus 4 e Claude Sonnet 4, que introduzem capacidades de "raciocínio híbrido" para combinar respostas rápidas com pensamento passo a passo estendido. Esses modelos sucedem a geração Claude 3.x e mantêm uma janela de contexto de 200.000 tokens, ao mesmo tempo que oferecem melhorias na segurança e nas capacidades agênticas.
Google lança modelo de raciocínio experimental Gemini 2.5 Pro com contexto de 1M tokens
O Google lançou o Gemini 2.5 Pro, seu primeiro modelo da família Gemini 2.5 e o modelo de raciocínio mais capaz até o momento. O modelo possui uma janela de contexto de entrada de 1 milhão de tokens (com planos de expansão), suporta entradas multimodais incluindo texto, imagem, áudio e vídeo, e está atualmente disponível por meio do plano Gemini Advanced e do Google AI Studio.
xAI lança Grok-1.5 com raciocínio aprimorado e contexto de 128K
A xAI anunciou o Grok-1.5, um novo modelo com capacidades de raciocínio aprimoradas e uma janela de contexto de até 128.000 tokens. O modelo estará disponível para testadores iniciais e usuários existentes na plataforma 𝕏 nos próximos dias.
TelecomGPT-R1: Pós-treinamento unificado para raciocínio em tarefas de telecomunicações heterogêneas
Pesquisadores apresentam o TelecomGPT-R1, uma família de modelos de raciocínio unificados de telecomunicações de código aberto, projetados para automatizar tarefas de engenharia por meio do raciocínio sobre padrões, configurações e logs. O modelo aborda as limitações dos LLMs generalistas e especializados existentes por meio de uma abordagem estruturada que abrange os eixos de protocolo, conhecimento, modelagem e falhas.