Источник · r/LocalLLaMA
media r/LocalLLaMA · 9 д назад · 13 просмотров

Обновление DeepSeek V4 Flash с улучшенными результатами в Terminal Bench и Toolathlon

DeepSeek обновил свою модель V4 Flash, выпустив новую версию 2026-07-31, которая демонстрирует значительный рост производительности по сравнению с предыдущей предварительной версией. Обновление включает результаты нескольких новых бенчмарков, а также улучшает показатели в существующих.

media r/LocalLLaMA · 1 д назад · 5 просмотров

Министерство энергетики США запускает инициативу Genesis Open Models и представляет Genesis-Science-1

Министерство энергетики США запустило инициативу Genesis Open Models и в партнерстве с Arcee представило свою первую модель с открытым весом для научных исследований под названием Genesis-Science-1.

media r/LocalLLaMA · 3 д назад ARC-AGI 3 · 95.5% · 2 просмотра

PrimeIntellect выпустила Prime Agent, самосовершенствующуюся среду для программирования

PrimeInteltech выпустила Prime Agent, агент с открытым исходным кодом для программирования и исследований, предназначенный для общих и длительных автономных задач. Система построена на pi и включает механизм самосовершенствующегося обучения с подкреплением с программным вызовом инструментов и многоагентным обменом сообщениями.

media r/LocalLLaMA · 4 д назад

США освобождают китайские модели с открытым весом от тестов на безопасность

Соединенные Штаты решили освободить китайские модели искусственного интеллекта с открытым весом от обязательных требований к тестированию безопасности. Этот сдвиг в политике означает, что компании, разрабатывающие эти конкретные модели, больше не будут подпадать под обычные оценки безопасности США.

media r/LocalLLaMA · 4 д назад · 2 просмотра

Qwen 3.8 Max набрал 1588 баллов в Debate Benchmark, по сравнению с 1462 у Qwen 3.7 Max

Qwen 3.8 Max достиг результата 1588 баллов на Debate Benchmark, улучшив показатель Qwen 3.7 Max, который составил 1462 балла. Этот бенчмарк оценивает, насколько хорошо большие языковые модели удерживают аргументацию в условиях состязательной многошаговой оппозииции по различным темам.

media r/LocalLLaMA · 4 д назад · 1 просмотр

Mistral AI представляет Shieldstral

Mistral AI объявила о выпуске новой модели под названием Shieldstral. Исходный контент содержит только заголовок и метаданные публикации без каких-либо дополнительных сведений о функциях, возможностях или назначении модели.

media r/LocalLLaMA · 5 д назад

AFM3 20B от Apple использует pruning следования инструкциям для активации ~20% слоёв

Apple представила новую архитектуру для своих фундаментальных моделей третьего поколения (AFM3), которая использует «Pruning следования инструкциям» для значительного снижения количества активных параметров. Модель спроектирована так, чтобы активировать примерно 20% своих MLP слоёв, принимая решения маршрутизации один раз на промпт, а не на токен.