vLLM выпустила версию 0.27.1, патчное обновление, построенное на основе предыдущего выпуска v0.27.0.
- Обновление вводит поддержку квантованных заголовков DSpark Markov.
vLLM выпустила версию 0.27.1, патчное обновление, построенное на основе предыдущего выпуска v0.27.0.
Релиз llama.cpp b10361 устраняет критическую ошибку, при которой Sliding Window Attention (SWA) не была включена для модели LGAI-EXAONE 4.5 из-за неверного порядка параметров при загрузке.
ALTK-Evolve — система агентной памяти, преобразующая траектории агентов в повторно используемые руководства без обновления весов; она сопоставима с ACE или превосходит её по точности, используя значительно меньше токенов. В отличие от ACE, который на каждом шаге внедряет полный свод правил, ALTK-Evolve использует селективный поиск для предоставления только релевантных руководств в зависимости от мощности модели.
Исследователи выявили сдвиг релевантной визуальной информации (RVIS) во время декодирования как основную причину отказа существующих методов отсечения визуальных токенов в мультимодальных больших языковых моделях (MLLM). Для решения этой проблемы они предлагают метод Decoding-stage Shift-aware Token Pruning (DSTP), не требующий обучения, который согласовывает визуальные токены с меняющимися требованиями рассуждения.
webAI выпустила TwIL-LM, семейство из двух логических вычислителей с 1,7B и 3B параметров, предназначенных для автоформализации на локальном оборудовании. Модели переводят английский текст в логику первого порядка и проверяют корректность заключений; вариант на 3B параметров достигает макросреднего показателя 0,4218 на задачах формальной логики из обучающей области.
Meta выпустила Muse Glimmer — плотную мультимодельную модель на 30B параметров, оптимизированную для локального развёртывания агентов под лицензией Apache 2.0, а также пообещала в будущем выпустить веса для Muse Spark 1.2.
Мы используем cookie для аналитики и улучшения сайта. Вы можете принять или отклонить аналитические cookie. Политика конфиденциальности