API & product launches
media MarkTechPost · 13 ч назад Berkeley Function-Calling Leaderboard · 70.94% · 3 просмотра

Pokee AI выпустила Pokee-Isaac 28B — модель с контекстом на 10M токенов для развёртывания в контролируемой среде

Pokee AI выпустила Pokee-Isaac 28B, текстовую базовую модель на 28 млрд параметров с контекстным окном на 10 млн токенов, предназначенную для работы исключительно в рамках границ, контролируемых клиентом. Модель доступна через API, совместимый с OpenAI, и лицензирована для развёртывания в VPC, локальных средах или на аппаратных средствах конечного пользователя, а не распространяется как open-weight.

lab xAI News · 21 ч назад · 11 просмотров

xAI выпускает Imagine Image 2.0 с точным редактированием и возможностями компоновки

xAI сделала Imagine Image 2.0 общедоступной в качестве нового режима качества, а также приложениями для iOS и Android. Обновление сосредоточено на точной генерации изображений и их редактировании для профессиональных творческих рабочих процессов.

github CrewAI · 1 д назад · 6 просмотров

LiteLLM 1.15.13 исправляет сохранение провайдера и заниженную отчетность по токенам кэша Anthropic

Версия LiteLLM 1.15.13 устраняет несколько ошибок, включая сохранение провайдера для моделей, маршрутизируемых через LiteLLM, и заниженную отчетность об использовании токенов кэша Anthropic.

lab OpenAI News · 3 д назад · 5 просмотров

OpenAI раскрывает глобальные тенденции внедрения и использования ChatGPT

Новые данные от OpenAI показывают, как пользователи по всему миру используют ChatGPT, предоставляя информацию на уровне стран о темпах внедрения и меняющихся моделях поведения.

lab OpenAI News · 3 д назад · 19 просмотров

ChatGPT обновляет GPT-5.6 Sol для пользователей Plus/Pro и устанавливает GPT-5.6 Luna по умолчанию для бесплатных пользователей

OpenAI обновляет ChatGPT, чтобы повысить фактическую надежность для пользователей Plus и Pro, а также расширить доступ для бесплатных пользователей. Обновление включает новый ползунок, позволяющий пользователям контролировать усилия на рассуждение, и меняет модель по умолчанию для бесплатных аккаунтов.

media Don't Worry About the Vase · 3 д назад · 2 просмотра

OpenAI снижает цены на Luna, Alibaba выпускает Qwen 3.8-Max, а руководство DeepMind меняется

Этот дайджест охватывает последние события в индустрии ИИ, включая значительные изменения цен со стороны OpenAI, выпуск новых моделей от Alibaba и крупные изменения в руководстве Google DeepMind.

lab Hugging Face Blog · 3 д назад · 1 просмотр

Baseten присоединяется к поставщикам инференса Hugging Face

Baseten теперь поддерживается как поставщик инференса на платформе Hugging Face Hub, что расширяет возможности бессерверного инференса непосредственно на страницах моделей. Эта интеграция позволяет разработчикам получать доступ к каталогу передовых моделей Baseten через клиентские SDK и пользовательский интерфейс Hugging Face.

media Latent Space · 5 д назад · 4 просмотра

OpenAI выпустила ChatGPT Work — агента для интеллектуального труда

9 июля OpenAI выпустила ChatGPT Work, новый продукт-агент, предназначенный для интеллектуального труда. Спустя три недели после запуска, по сообщениям, количество пользователей продукта вместе с Codex превысило 10 миллионов.

lab OpenAI News · 5 д назад · 9 просмотров

OpenAI представляет образовательные плагины для ChatGPT Work и Codex

OpenAI выпустила три новых плагина для ChatGPT Work и Codex, предназначенных для помощи учителям K–12, преподавателям колледжей и студентам с помощью агентных возможностей. Эти инструменты интегрируются с существующими учебными материалами и приложениями, помогая пользователям планировать уроки, разрабатывать курсы и создавать персонализированные учебные пособия без необходимости составлять сложные промпты.

lab Google — The Keyword (AI) · 5 д назад · 2 просмотра

Google анонсировала Gemini 3.6 Flash, Lyria 3.5 и спутники FireSat в июле 2026 года

Google выпустила несколько обновлений ИИ в июле 2026 года, включая новые модели Gemini для разработчиков, модель генерации музыки и спутниковые технологии для обнаружения лесных пожаров.

lab OpenAI News · 5 д назад · 9 просмотров

Circles использует OpenAI для создания AI Concierge и Xplore IQ для телеком-операторов

Circles использует технологии OpenAI для построения нативного для ИИ стека телекоммуникаций, развертывая многоагентную архитектуру CareX для поддержки клиентов и движок Xplore IQ для персонализации. Эта интеграция обеспечивает проактивное взаимодействие с учетом контекста, которое в реальном времени связывает поддержку, операции и монетизацию.

media MarkTechPost · 6 д назад GPQA Diamond · 92.6% · 9 просмотров

Alibaba выпустила Qwen3.8-Max — MoE-модель с 2,4 трлн параметров

Команда Qwen компании Alibaba сделала модель Qwen3.8-Max широко доступной через API; открытые веса как для Qwen3.8-Max, так и для более компактной контрольной точки Qwen3.8-27B запланированы на следующую неделю. Флагманская модель представляет собой архитектуру mixture-of-experts с 2,4 триллионами параметров и поддерживает ввод текста, изображений и видео.

media Together AI Blog · 7 д назад · 9 просмотров

Moonshot выпустила Kimi K3, самую большую модель с открытым весом на 2,8 триллиона параметров

Moonshot AI выпустила Kimi K3 — модель с открытым весом на 2,8 триллиона параметров, предназначенную для долгосрочного программирования и глубокого рассуждения. Это первая в мире модель с открытым исходным кодом класса в 3 триллиона параметров, поддерживающая контекстное окно на 1 миллион токенов.

media MarkTechPost · 8 д назад · 15 просмотров

MiniMax выпустила модель MiniMax H3 для создания видео в омни-модальном формате с нативным стереозвуком и разрешением 2K

Компания MiniMax выпустила модель MiniMax H3 — универсальную мультимодальную модель генерации, которая объединяет текст, изображения, видео и аудио в едином контексте для создания видеоклипов длительностью до 15 секунд с нативным стереозвуком. В отличие от предыдущих стеков, использующих отдельные специализированные модели для конкретных задач, H3 позволяет пользователям задавать отношения между ссылками и редактированием с помощью текстовых запросов.

lab xAI News · 8 д назад · 5 просмотров

xAI добавила ссылки на изображения и голос в Imagine Video 1.5

xAI обновила свою модель Imagine Video 1.5 для поддержки текстовых, изображений и голосовых ссылок, что позволяет пользователям генерировать видео разрешением до 1080p. Обновление обеспечивает согласованность персонажей путем фиксации лиц и голосов между сценами, поддерживая до семи ссылок на одну генерацию.

media r/LocalLLaMA · 8 д назад · 1 просмотр

DeepSeek V4 Flash выпущен как высокопроизводительная и недорогая модель с открытыми весами

DeepSeek выпустила свою новую flash-модель DeepSeek V4 Flash, которая позиционируется как вторая по качеству среди моделей с открытыми весами после Kimi K3, предлагая при этом значительно более низкие цены. Модель стоит $0.09 за входные токены и $0.18 за выходные токены на миллион токенов.

media TLDR AI · 9 д назад · 6 просмотров

Релиз Inkling-Small, снижение цен на GPT-5.6, Gemini Robotics ER 2

Компания Thinking Machines выпустила модель Inkling-Small с 276B параметров (mixture-of-experts), из которых 12B являются активными. Модель сохраняет мультимодальные способности к рассуждению и контекстное окно на 1M токенов, при этом потребляя меньше вычислительных ресурсов.

lab OpenAI News · 9 д назад ARC-AGI 3 · 38.3% · 6 просмотров

OpenAI снижает цену на GPT-5.6 Luna на 80 процентов

OpenAI объявила о значительном снижении цен на семейство моделей GPT-5.6, уменьшив стоимость GPT-5.6 Luna на 80 процентов и GPT-5.6 Terra на 20 процентов. Компания представляет эти изменения как часть более широкой стратегии по повышению доступности и полезности передового ИИ за счет улучшения эффективности инфраструктуры.

media MarkTechPost · 9 д назад · 1 просмотр

PolyAI выпускает Dialog-RSN-1, аудио-нативную модель диалога

PolyAI представила Dialog-RSN-1, модель диалога, которая обрабатывает сырой голосовой вызов напрямую, а не полагается на транскрипты. Она объединяет управление очередями, распознавание речи, вызов функций и генерацию ответов в единую систему, aware аудио.

lab DeepSeek API Docs · 9 д назад Terminal-Bench 2 · 82.7% · 7 просмотров

DeepSeek выпускает DeepSeek-V4-Flash в публичную бета-версию с улучшенными возможностями агента

DeepSeek запустила официальную публичную бета-версию API DeepSeek-V4-Flash, которая предлагает значительно расширенные возможности агента по сравнению с V4-Pro-Preview. Обновление включает повторное дообучение модели при сохранении её исходной архитектуры и размера.