OpenAI ha publicado los primeros resultados medidos de rendimiento para Jalapeño, su chip de inferencia personalizado, junto con una descripción detallada de su estrategia de computación de "inteligencia abundante" integrada. La empresa describe cómo combina centros de datos, chips, modelos y software para mejorar la eficiencia y la economía en todo su sistema.

  • Jalapeño ofreció mayor rendimiento pico por kilovatio y menor latencia de tokens que los sistemas comerciales en el benchmark InferenceX utilizando GPT-OSS 120B.
  • El chip tuvo un desempeño sólido en DeepSeek R1 y Kimi K2, demostrando mejoras en diferentes familias de modelos.
  • OpenAI gestiona una diversa cartera de hardware que incluye a Microsoft, NVIDIA, AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy y SoftBank.
  • GPT-5.6 Sol con razonamiento máximo alcanzó un nuevo récord en el Índice de Agentes de Codificación de Artificial Analysis mientras usaba un 54% menos de tokens de salida que un modelo líder.

Este enfoque busca brindar mayor control sobre la economía del servicio de modelos y crear una ruta creíble de primera parte para el silicio, garantizando el mejor rendimiento por dólar a medida que evoluciona la tecnología.