A OpenAI divulgou os primeiros resultados de desempenho do Jalapeño, seu primeiro chip de inferência personalizado, demonstrando ganhos significativos em velocidade e eficiência energética em comparação com sistemas comerciais existentes. A empresa afirma que a nova arquitetura permite maior vazão e menor latência simultaneamente, abordando uma troca comum no hardware atual.
- O Jalapeño entregou de 1,5 a 1,9 vezes mais trabalho de IA por watt na vazão máxima do que os sistemas de comparação.
- A latência de ponta a ponta foi reduzida em 1,7 a 3,6 vezes nos modelos testados, incluindo GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T.
- Para cargas de trabalho altamente interativas, o chip forneceu desempenho de 2,1 a 4,1 vezes maior.
- O sistema atingiu um consumo de energia sustentado igual ou inferior a 550 watts, apesar da classificação de 700 watts.
Essas melhorias visam tornar a IA cada vez mais capaz acessível e amplamente disponível, reduzindo o custo de entrega de resultados bem-sucedidos enquanto apoia iterações mais rápidas para cargas de trabalho agênticas.