A OpenAI divulgou os primeiros resultados medidos de desempenho do Jalapeño, seu chip de inferência personalizado, juntamente com uma visão detalhada de sua estratégia de computação de "inteligência abundante" integrada. A empresa descreve como combina data centers, chips, modelos e software para melhorar a eficiência e a economia em todo o seu sistema.
- O Jalapeño entregou maior taxa de transferência de pico por quilowatt e menor latência de tokens do que sistemas comerciais no benchmark InferenceX usando GPT-OSS 120B.
- O chip teve desempenho sólido no DeepSeek R1 e Kimi K2, demonstrando ganhos em diferentes famílias de modelos.
- A OpenAI gerencia um portfólio diversificado de hardware incluindo Microsoft, NVIDIA, AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy e SoftBank.
- O GPT-5.6 Sol com raciocínio máximo atingiu um novo recorde no Artificial Analysis Coding Agent Index enquanto usava 54% menos tokens de saída do que um modelo líder.
Essa abordagem visa fornecer maior controle sobre a economia de serviço de modelos e criar um caminho credível de primeira mão para o silício, garantindo o melhor desempenho por dólar à medida que a tecnologia evolui.