Проект PearlOS запустил открытую платформу для распределённого интеллекта, которая использует локальные модели для выполнения многомодальных задач. Она автоматически выбирает и переключается между наиболее эффективными моделями на основе критериев оценки, обеспечивая пользователям постоянный доступ к самым новым и наиболее мощным моделям, не завися от закрытых систем или подписок.
Мощь интеллекта лучше лежит в руках людей, чем в кабинетах магнатов
Thinking Machines выпускает Inkling, Tencent обновляет Hy3 с лицензией Apache 2.0
Последний обзор артефактов открытых моделей выделяет значительные релизы от Thinking Machines и Tencent, а также обновления от Poolside и DeepSeek.
Moonshot выпустила модель Kimi K3 с открытыми весами и инфраструктуру
Moonshot опубликовала полные детали, веса и сопутствующую инфраструктуру для Kimi K3 — модели Mixture-of-Experts на 2.8T параметров с примерно 104B активных параметров на токен. В релиз вошли технические отчеты, описывающие её гибридный стек длинного контекста, и новые инструменты, такие как MoonEP, FlashKDA и AgentEnv.
Сравнение Kimi K3, DeepSeek V4 Pro и GLM-5.2 по бенчмаркам, лицензии и стоимости обслуживания
Сравнение трёх моделей с открытыми весами на основе разреженного Mixture-of-Experts — Kimi K3 от Moonshot AI, DeepSeek V4 Pro и GLM-5.2 от Zhipu AI — оценивает их возможности, условия лицензирования и стоимость обслуживания для задач программирования и работы агентов с длинным горизонтом.
InternLM выпустила мультимодельную модель Intern-S2-397B для научного интеллекта
InternLM представила Intern-S2-397B, 397-миллиардную мультимодельную базовую модель, предназначенную для научного интеллекта и агентов с длительным горизонтом планирования. Модель масштабируется по этапам предварительного обучения, охвату задач reinforcement-learning и интерактивным средам агентов, чтобы улучшить общие способности к рассуждению и агентные возможности.
DeepSeek выпустила V4-1 Flash, модель MoE на 552B с контекстом в 1 млн токенов
DeepSeek выпустила свою новую модель DeepSeek V4-1 Flash. Это мультимодельная Mixture-of-Experts (MoE) модель с базовой архитектурой на 552 миллиарда параметров.