vLLM представил новый парсер потока для Qwen3+, доступный в его ночной сборке, который решает проблемы, такие как остановка на промежуточных этапах и сбой вызова потока инструментов из-за границ блоков. Обновление, по данным, устраняет эти проблемы при ограниченных тестах, повышая надежность для агентных рабочих процессов.
vLLM выпустил новый парсер потока для Qwen3+ в ночной версии
CORTIS: текстовое адаптация моделей речи
CORTIS позволяет голосовым агентам, ориентированным на задачи, генерировать структурированные речевые выходы путем тонкой настройки моделей речи с использованием только текстовой задачной поддержки. Он превосходит архитектуры ASR-LLM при ухудшении акустических характеристик, особенно в сохранении высокого уровня семантики задач, не требуя парных аннотаций речи и целей во время обучения.
ExecCritic использует специфичное для роли обучение с подкреплением для улучшения кодогенерирующих агентов посредством ремонта, направляемого тестами
ExecCritic представляет собой фреймворк, который разделяет конструирование тестов и исправление исходного кода, чтобы предотвратить ложное доверие к кодогенерирующим агентам. Система использует Test agent и Repair agent, оба из которых поддерживаются моделью Qwen-3.5-35B-A3B и обучаются отдельно с помощью обучения с подкреплением.
Alibaba выпустила превью-веса Qwen3.8-Flash-Next на 176B для агентного программирования
Alibaba выпустила веса модели Qwen3.8-Flash-Next, служащие превью будущей архитектуры Qwen4 для экспериментов и оценки разработчиками.
Релиз Qwen 3.8 Max: акцент на планировании, упрощении и экспериментальном дизайне
Полный релиз Qwen 3.8 Max подтверждает первоначальные впечатления о том, что модель работает исключительно быстро, высоко способна к планированию и искусно выявляет ненужную сложность в задачах.
Qwen3.6-27b-mtp-q8 создает реализацию поиска пути A* через автономное тестирование
Модель Qwen3.6-27b-mtp-q8 успешно сгенерировала реализацию поиска пути A* для игры на Java, используя Claude Code локально. Процесс включал почти 12 часов итеративной разработки, в ходе которых модель автономно создавала и запускала набор тестов.