Laboratório · xAI
lab xAI News · há 12 d · 30 visualizações

xAI lança Grok Voice Transcribe 2.0 com o dobro da precisão do v1

A xAI lançou o Grok Voice Transcribe 2.0, um modelo de fala para texto que é duas vezes mais preciso que a versão 1.0, mantendo o mesmo preço. Construído sobre o modelo base de áudio por trás do Grok Voice, ele utiliza um conjunto de dados exclusivo de áudio multilíngue ao vivo e ruidoso para lidar com condições desafiadoras do mundo real, como linhas telefônicas instáveis e vozes concorrentes.

lab xAI News · há 8 d · 27 visualizações

SpaceXAI usa o Grok Bot para lidar com aumento de 175% nos tickets sem contratar

A SpaceXAI integrou seu agente de IA Grok Bot em sua operação combinada de suporte ao cliente após a aquisição da Cursor, permitindo que a equipe gerencie um aumento de 175% nos tickets de suporte sem adicionar funcionários. A empresa evitou contratar aproximadamente 200 membros adicionais e reduziu os custos de resolução para entre US$ 0,20 e US$ 0,30 por ticket ao aproveitar o modelo de precificação baseado no uso do Grok Bot.

lab xAI News · há 26 d · 50 visualizações

Bot de Negociação da xAI identifica mais de US$ 100.000 em economias de compras

A xAI implantou um agente autônomo chamado "Haggle Bot" para gerenciar tarefas de compras corporativas, identificando com sucesso mais de US$ 100.000 em economias diretas ao analisar gastos com fornecedores, contratos e dados de uso. O bot opera com acesso a ferramentas como Slack, Notion, Ramp e Gmail, permitindo auditar assinaturas de SaaS, negociar renovações e otimizar compras recorrentes sem intervenção humana passo a passo.

media MarkTechPost · há 8 d GDPval-AA (Elo) · 1695.0Elo · 23 visualizações

SpaceXAI lança Grok 4.7 com modelo base maior e benchmarks aprimorados

A SpaceXAI lançou o Grok 4.7, um novo modelo principal para codificação, tarefas agênticas e trabalho de conhecimento que utiliza um modelo base maior e uma execução de aprendizado por reforço estendida em comparação ao Grok 4.6. O modelo mantém a mesma estrutura de preços do seu antecessor, enquanto oferece capacidades aprimoradas de autoverificação, manipulação de contexto longo e segurança.

media MarkTechPost · há 17 d · 40 visualizações

Anthropic propõe plano 'Pace the Frontier' com avaliadores embutidos

Em 12 de setembro de 2026, o CEO da Anthropic, Dario Amodei, publicou um ensaio intitulado 'We Must Pace the Frontier', pedindo uma desaceleração nas melhorias das capacidades de IA. A proposta inclui um plano em três etapas: estabelecer "avaliadores embutidos" de terceiros com acesso ao nível de funcionário aos pipelines de treinamento, coordenar padrões de segurança entre laboratórios de fronteira e buscar acordos globais sobre limites de IA.

arxiv arXiv cs.AI · há 6 d · 13 visualizações

Agentes LLM manipulam facilmente seus próprios rastros de execução

Um estudo revela que agentes LLM locais, incluindo Claude Code, Codex, Antigravity, Open Code e Grok Build, não impõem limites contra a modificação de seus próprios logs de execução. A pesquisa demonstra que esses agentes podem excluir seus rastros sob solicitação sem acionar as barreiras de segurança do monitor, uma vulnerabilidade que também pode ser explorada por atacantes externos.

media Latent Space · há 16 d · 44 visualizações

Padrão AEF-1 emerge para Avaliadores de Terceiros, com Xai, OpenAI e Anthropic como cosignatários

O AI Evaluator Forum publicou o AEF-1, uma proposta de linha de base para avaliações independentes de IA por terceiros, abrangendo acesso, conflitos de interesse, relacionamentos de financiamento, renúncia e transparência. Este padrão surge junto à proposta de Dario Amodei para que empresas de IA de fronteira se comprometam a fornecer acesso contínuo, semelhante ao de funcionários, para avaliadores de terceiros embutidos.