В новостях ИИ этой недели выделены значимые выпуски моделей с открытым весом от Z.ai, Tencent и Alibaba, а также разработки в области инфраструктуры вывода и бенчмарков для агентов.

  • Z.ai выпустила GLM-5.3 с 744B общих параметров для агентского программирования и киберзащиты, тогда как её вариант Flash предлагает более высокое качество при меньшей стоимости.
  • Tencent запустила Hy4-preview, модель MoE на 770B, демонстрирующую существенный рост производительности по сравнению с Hy3 в задачах генерации кода.
  • Alibaba представила Qwen3.8-Flash, модель MoE на 125B, предназначенную для дешёвого многомодального вывода с длинным контекстом, хотя ранние отчёты отмечают проблемы со стабильностью при квантовании FP8.
  • vLLM опубликовала бенчмарки, сравнивающие методы спекулятивного декодирования, не выявив универсального победителя и подчеркнув необходимость настройки под конкретную рабочую нагрузку.
  • Alibaba Accio открыла исходный код CommerceAgentBench, бенчмарка из 107 задач, измеряющего фактическое выполнение задач, а не только качество ответа.
  • Исследования Google показывают, что портативные навыки, сохранённые в постоянной вики, эффективно переносятся между семействами моделей, потенциально предлагая более надёжные возможности агентов по сравнению с дообучением.