OpenAI ha publicado los resultados iniciales de rendimiento de Jalapeño, su primer chip de inferencia personalizado, demostrando ganancias significativas en velocidad y eficiencia energética en comparación con los sistemas comerciales existentes. La empresa afirma que la nueva arquitectura permite un mayor rendimiento y menor latencia simultáneamente, abordando una compensación común en el hardware actual.
- Jalapeño entregó de 1,5 a 1,9 veces más trabajo de IA por vatio en el pico de rendimiento que los sistemas de comparación.
- La latencia de extremo a extremo se redujo entre 1,7 y 3,6 veces en los modelos probados, incluidos GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T.
- Para cargas de trabajo altamente interactivas, el chip proporcionó un rendimiento de 2,1 a 4,1 veces mayor.
- El sistema logró un consumo de energía sostenido igual o inferior a 550 vatios a pesar de una clasificación de 700 vatios.
Estas mejoras tienen como objetivo hacer que la IA cada vez más capaz sea más asequible y ampliamente disponible al reducir el costo de entregar resultados exitosos, mientras se admite una iteración más rápida para cargas de trabajo agénticas.