OpenAI объявила о сотрудничестве с Broadcom в разработке пользовательского чипа для вывода под названием Jalapeño. Это новое аппаратное обеспечение специально предназначено для ускорения развертывания больших языковых моделей. Партнерство направлено на снижение зависимости от сторонних ускорителей для задач вывода OpenAI. Интегрируя собственную кремниевую продукцию, OpenAI стремится оптимизировать производительность и эффективность своих приложений ИИ. Это объявление подчеркивает стратегический шаг к вертикальной интеграции в инфраструктуре ИИ. Детали, касающиеся конкретных технических характеристик или сроков выпуска, не были предоставлены в первоначальном сообщении.
OpenAI и Broadcom объявили о создании чипа для вывода Jalapeño
OpenAI присоединяется к проекту PORTS-Pike
OpenAI заключила соглашение о получении примерно 8 гигаватт-IT на технологическом кампусе PORTS-Pike в округе Пайк, штат Огайо, в партнерстве с SB Energy, NVIDIA и Министерством энергетики США.
NVIDIA запускает Qwen 3.8 2.4T на GB300 NVL72 со скоростью 4K токенов/с на GPU
NVIDIA продемонстрировала развертывание модели Qwen 3.8 2.4T с параметрами и настраиваемыми возможностями рассуждения на аппаратной платформе GB300 NVL72.
OpenAI Python SDK v0.21.0 добавляет провайдер-независимые API тестирования и совместимость с OpenAI v3
OpenAI выпустила версию 0.21.0 пакета openai-agents-python, представив новые утилиты тестирования, независимые от провайдера, и обновив совместимость для версии 3 библиотеки OpenAI Python.
OpenAI демонстрирует режим Ultrafast для GPT-5.6 Sol; Google выпускает Gemini 3.7 Flash
OpenAI продемонстрировала режим Ultrafast, вариант GPT-5.6 Sol, способный генерировать до 750 выходных токенов в секунду и работать со скоростью до 14x от стандартной скорости обработки. Этот подход направлен на обеспечение производительности в реальном времени без переключения на более маленькую модель.
Google выпустила Gemini 3.7 Flash; DeepSeek открыла исходный код Harness
Google выпустила Gemini 3.7 Flash, свою новую модель среднего уровня для программирования и агентных рабочих процессов, с 50-процентной скидкой на старте и значительным улучшением результатов в бенчмарках по сравнению с версией 3.6. Эта модель позиционируется как рабочая лошадка для разработки, с немедленной интеграцией в Gemini API, Android Studio и внешние инструменты, такие как Cline.