Z.ai выпустила GLM-5.3, модель для кодинга и кибербезопасности, созданную на основе дообучения (post-training) своей базовой модели 743B, а не нового препроцессинга (pretraining). В релиз включены конкретные результаты бенчмарков: Terminal Bench 3.0 — 28.3 и DeepSWE — 66.9.
Alibaba выпустила Qwen3.8-27B, нативную мультимодальную плотную модель с контекстом 262K, расширяемым до 1M с помощью YaRN, предназначенную для локального использования на 17GB RAM. Тем временем Cursor объявил о присоединении к SpaceXAI для работы над Grok и связанными продуктами.
В статье отмечается тенденция специализации китайских лабораторий на моделях с открытым весом (open-weight) и рантаймах агентов, которые становятся целями оптимизации, а также скептицизм в отношении заявлений вендоров о результатах бенчмарков.