Лаборатория · Zhipu AI
lab Zhipu / Z.ai (GLM, HF) · 26 д назад · 53 просмотра

Zhihui AI выпускает GLM-5.3 с улучшенными возможностями программирования и кибербезопасности

Компания Zhihui AI выпустила GLM-5.3, модель с открытыми весами, которая построена на базовой архитектуре GLM-5.2 за счёт улучшений после обучения. Обновление значительно повышает производительность в сложных задачах программирования и долгосрочных сценариях, устанавливая новые рекорды на нескольких публичных бенчмарках.

lab Zhipu / Z.ai (GLM, HF) · 26 д назад · 55 просмотров

Zai выпустила GLM-5.3 с улучшенными возможностями программирования и кибербезопасности

Zai выпустила GLM-5.3, модель с открытыми весами, которая построена на базовой архитектуре GLM-5.2 благодаря обширной постобучению. Обновление обеспечивает значительный прогресс в сложных задачах программирования и долгосрочных сценариях, устанавливая новые рекорды на нескольких публичных бенчмарках.

lab Zhipu / Z.ai (GLM, HF) · 28 д назад · 69 просмотров

Zai выпустила GLM-5.3-Flash: мультимодальную модель на 320B с разреженно-линейным вниманием

Zai представила GLM-5.3-Flash, первую нативно мультимодальную модель в серии GLM-5. Она сочетает гибридную архитектуру с разреженным и линейным вниманием для снижения стоимости обслуживания длинных контекстов при сохранении высокой точности.

lab Zhipu / Z.ai (GLM, HF) · 28 д назад · 76 просмотров

ZhiPu выпустила GLM-5.3-Flash, мультимодальную модель с 320B параметров

ZhiPu представляет GLM-5.3-Flash, первую нативно мультимодальную модель в серии GLM-5, использующую гибридную архитектуру, сочетающую разреженное и линейное внимание для снижения затрат на обслуживание длинного контекста при сохранении точности.

media Together AI Blog · 25 д назад · 50 просмотров

Дистилляция GLM-5.3 Flash жертвует надёжностью ради снижения стоимости в 17 раз

Сравнение GLM-5.3 и её дистиллированной версии GLM-5.3 Flash на бенчмарке DeepSWE показывает, что дистилляция сохраняет базовые способности к программированию, значительно снижая стоимость генерации ответов. Полная модель достигает показателя pass@1 на уровне 69,0% при стоимости $3,99 за задачу, тогда как версия Flash набирает 63,4% всего за $0,24, что представляет собой снижение цены в 17 раз.

media AI News (smol.ai) · 27 д назад GDPval-AA (Elo) · 1770.0Elo · 57 просмотров

Z.ai выпускает GLM-5.3-Flash: мультимодельную модель с 320 млрд параметров и контекстом на 1 млн токенов

Z.ai официально выпустила GLM-5.3-Flash, раскрыв, что ранее представленная модель "Ox Alpha" является её публичным именем. Модель имеет 320 миллиардов общих параметров, из которых 18 миллиардов активны, контекстное окно на 1 миллион токенов и нативные мультимодальные возможности.

media MarkTechPost · 27 д назад · 73 просмотра

Z.ai выпускает GLM-5.3-Flash: мультимодальную MoE-модель с 320B параметров и контекстом в 1 млн токенов

Z.ai выпустила GLM-5.3-Flash, первую нативно мультимодальную модель в серии GLM-5, использующую архитектуру mixture-of-experts с общим количеством параметров 320 миллиардов и 18 миллиардами активных на токен. Модель поддерживает ввод изображений и видео в окне контекста длиной 1 048 576 токенов и доступна по лицензии MIT на Hugging Face.

media r/LocalLLaMA · 28 д назад · 87 просмотров

Zhipu AI выпустила GLM-5.3-Flash, мультимодальную модель с открытыми весами

Zhipu AI выпустила GLM-5.3-Flash, первую нативно мультимодальную модель в серии GLM-5 и первый релиз архитектуры glm5_next с открытыми весами. Модель с 320B параметров обучена на 30T-токенном мультимодальном корпусе и использует гибридный механизм внимания, сочетающий разреженность и линейность, для снижения затрат на обслуживание длинного контекста.

arxiv arXiv cs.CL · 7 ч назад · 11 просмотров

TelecomGPT-R1: Единое постобучение для рассуждений в гетерогенных телекоммуникационных задачах

Исследователи представляют TelecomGPT-R1, семейство открытых унифицированных моделей рассуждений для телекоммуникаций, предназначенных для автоматизации инженерных задач путем анализа стандартов, конфигураций и журналов. Модель решает ограничения существующих универсальных и специализированных LLM посредством структурированного подхода, охватывающего протоколы, знания, моделирование и устранение неисправностей.

arxiv arXiv cs.LG · 1 д назад HealthBench · 50.1% · 10 просмотров

Fathom-Vaidya улучшает медицинское рассуждение с помощью наград по рубрикам

Авторы представляют Fathom-Vaidya, модель с 30B параметров, которая использует синтетические данные и подкрепляющее обучение на основе рубрик для улучшения диагностического и клинического рассуждения в здравоохранении. Процесс обучения сначала применяет RL, управляемый правилами, к вопросам из MedBullets для диагностики, а затем использует 5.3k синтетических многошаговых сценариев с многомерными рубриками для интерактивных клинических задач.

media r/LocalLLaMA · 4 д назад · 23 просмотра

ZCode тайно загружает всю историю Git и рабочее пространство в Aliyun OSS

Официальное приложение для ИИ-разработки Zhipu, ZCode, оказалось упаковывающим и загружающим полные рабочие пространства пользователей при входе в систему. Этот процесс включает шифрование данных и их прямую отправку в Aliyun OSS.

arxiv arXiv cs.CL · 6 д назад · 22 просмотра

Модели уровня Frontier оцениваются в игре log(N)-вопросов по Википедии

Исследование оценивает шесть языковых моделей уровня Frontier в задаче коммуникации двух агентов, где отвечающий на вопросы определяет цель из N абзацев Википедии, используя ровно log2(N) вопросов с ответами «да»/«нет». Эксперимент провёл 408 игр на наборах документов от 4 до 1024 абзацев, выявив значительные различия в производительности среди протестированных моделей.

media r/LocalLLaMA · 10 д назад · 20 просмотров

InternLM выпустила мультимодельную модель Intern-S2-397B для научного интеллекта

InternLM представила Intern-S2-397B, 397-миллиардную мультимодельную базовую модель, предназначенную для научного интеллекта и агентов с длительным горизонтом планирования. Модель масштабируется по этапам предварительного обучения, охвату задач reinforcement-learning и интерактивным средам агентов, чтобы улучшить общие способности к рассуждению и агентные возможности.

arxiv arXiv cs.CL · 13 д назад · 28 просмотров

Односторонняя атака на GLM-5.3-Flash выявляет хрупкость безопасности в моделях MoE

Исследователи демонстрируют, что направленная абляция — атака с открытым исходным кодом, устраняющая отказ путем проецирования одного направления из весов, остается эффективной для передовых моделей смешанных экспертов (MoE), таких как GLM-5.3-Flash. Исследование показывает, что хотя атака выживает в архитектуре, ее эффекты распределяются по вниманию, плотным и маршрутизируемым экспертам, а не сосредоточены в одном месте.

arxiv arXiv cs.CL · 22 д назад · 37 просмотров

CogEvol выпускает модель 4B для эффективной генерации обучающей среды

CogEvol представляет семейство моделей, предназначенных для преобразования учебных материалов в структурированные JSON-слайды или интерактивные HTML-страницы за один проход, заменяя многошаговую агентную архитектуру. Система использует производственно ориентированный конвейер данных и гибридные механизмы вознаграждения для обеспечения надежности во время обучения.

arxiv arXiv cs.CL · 22 д назад · 33 просмотра

WebWorld использует браузер как модель мира для самостоятельного улучшения веб-кода

Авторы представляют WebWorld, интерфейс, который позволяет Vision-Language Model (VLM) автономно взаимодействовать с браузером как с детерминированной моделью мира для веб-кода. Этот подход устраняет структурный недостаток самосовершенствования на основе VLM, при котором модель оценивает собственные исправления, вводя контрагента, которого невозможно обмануть.