OpenAI ha publicado los resultados iniciales de rendimiento de Jalapeño, su primer chip de inferencia personalizado, demostrando ganancias significativas en velocidad y eficiencia energética en comparación con los sistemas comerciales existentes. La empresa afirma que la nueva arquitectura permite un mayor rendimiento y menor latencia simultáneamente, abordando una compensación común en el hardware actual.

  • Jalapeño entregó de 1,5 a 1,9 veces más trabajo de IA por vatio en el pico de rendimiento que los sistemas de comparación.
  • La latencia de extremo a extremo se redujo entre 1,7 y 3,6 veces en los modelos probados, incluidos GPT-OSS 120B, DeepSeek R1 y Kimi K2.5 1T.
  • Para cargas de trabajo altamente interactivas, el chip proporcionó un rendimiento de 2,1 a 4,1 veces mayor.
  • El sistema logró un consumo de energía sostenido igual o inferior a 550 vatios a pesar de una clasificación de 700 vatios.

Estas mejoras tienen como objetivo hacer que la IA cada vez más capaz sea más asequible y ampliamente disponible al reducir el costo de entregar resultados exitosos, mientras se admite una iteración más rápida para cargas de trabajo agénticas.