A OpenAI apresentou o GPT-6 Astra como seu modelo mais inteligente até o momento, ao mesmo tempo em que delineou sua estratégia de computação em pilha completa, que inclui o novo chip de inferência Jalapeño. A empresa relata que seu hardware personalizado oferece uma taxa de pico de tokens por watt 1,5 a 1,9 vezes maior em comparação com sistemas comerciais nos testes do InferenceX.
- O GPT-6 Astra é descrito como estado da arte em uso de computador, navegação, engenharia de software, cibersegurança, ciência e trabalho profissional.
- O chip de inferência Jalapeño reduz a latência de ponta a ponta em 1,7 a 3,6 vezes em comparação com os sistemas comerciais testados.
- O GPT-5.6 Sol melhorou o software de serviço de produção, reduzindo os custos de serviço de ponta a ponta em 20% e aumentando a eficiência da geração de tokens em mais de 15 por cento.
- A organização de pesquisa da OpenAI agora utiliza 3,1 dias-agente de esforço para cada dia de trabalho de mão de obra humana.
Esses avanços visam reduzir o custo e aumentar a velocidade das tarefas de IA, permitindo que os clientes obtenham mais resultados com menos tentativas, ao mesmo tempo em que apoiam o crescimento da OpenAI por meio de fluxos de receita diversificados.