OpenAI опубликовала детали бенчмарков для своего собственного чипа вывода Jalapeño, заявив о превосходной эффективности и задержках по сравнению с системами NVIDIA GB200/GB300. Одновременно Perplexity запустила Portable Computer на аппаратном обеспечении NVIDIA DGX Spark, что позволяет полностью локально оркестровывать агентов без зависимости от облака.

  • Jalapeño от OpenAI показал выполнение работы на 1.5–1.9× больше на ватт и задержку на 1.7–3.6× ниже по сравнению с системами NVIDIA в тестах.
  • Чип рассчитан на 700 Вт, но во время тестирования потреблял менее 550 Вт; развертывание запланировано до конца года.
  • Portable Computer от Perplexity локально запускает оркестратор LLM, подагента LLM и оболочку агента, используя PPLX 27B или Qwen 3.8 27B.
  • Microsoft-led AutoSaddler сообщил о приросте +9.0 на GAIA2 и +10.0 на Terminal-Bench 2.0 за счет обработки оболочки агента как кода.
  • SWE Refactor Bench обнаружил лишь 5.4% выживаемости для задач миграции всего репозитория по 520 запускам.

Эти события подчеркивают сдвиг в сторону специализированного аппаратного обеспечения для вывода и локально-ориентированных архитектур агентов, снижающих зависимость от облачной инфраструктуры.