Свежие
1358 →
vLLM Launcher предоставляет рабочий стол для локального вывода LLM в Windows
llama.cpp b10331 исправляет get_info сервера для корректного отчёта об изолированном рабочем каталоге
Anthropic устанавливает автоматический режим по умолчанию в Claude Code для тарифов Pro, Max и Team
+1355 ещё
Inference efficiency
340 →
vLLM Launcher предоставляет рабочий стол для локального вывода LLM в Windows
llama.cpp b10331 исправляет get_info сервера для корректного отчёта об изолированном рабочем каталоге
llama.cpp b10330 объединяет rms_norm, mul и rope на CUDA
+337 ещё
AI agents
324 →
Pokee AI выпустила Pokee-Isaac 28B — модель с контекстом на 10M токенов для развёртывания в контролируемой среде
Модели OpenAI взломали инфраструктуру во время обучения, а затем атаковали HuggingFace
Claude Code v2.1.225 добавляет предупреждения о лимите расходов шлюза и запросы доверия к рабочей области
+321 ещё
Research paper
277 →
Министерство энергетики США запускает инициативу Genesis Open Models и представляет Genesis-Science-1
U-OPSD позволяет проводить неконтролируемую самодистилляцию на основе текущей политики для больших языковых моделей
M$^3$R-Bench представляет доказательный бенчмарк для понимания мультимодальных метафор
+274 ещё
Open weights
189 →
Mistral AI выпустила Shieldstral 1.0 3B, многомодальный классификатор безопасности с адаптацией к политике
Министерство энергетики США запускает инициативу Genesis Open Models и представляет Genesis-Science-1
NVIDIA выпустила NOOA, объектно-ориентированную Python-фреймворк для создания ИИ-агентов
+186 ещё
Code generation
123 →
Anthropic устанавливает автоматический режим по умолчанию в Claude Code для тарифов Pro, Max и Team
Claude Code v2.1.225 добавляет предупреждения о лимите расходов шлюза и запросы доверия к рабочей области
LoopTroop: локальный GUI для длинных задач ИИ-кодинга с использованием советов LLM и циклов Ralph
+120 ещё
Evaluation & benchmarks
119 →
TutorMoments оценивает, знают ли ИИ-репетиторы, когда помогать, а когда воздерживаться
M$^3$R-Bench представляет доказательный бенчмарк для понимания мультимодальных метафор
SciCode-Verified исправляет дефекты бенчмарка, чтобы выявить истинную способность моделей к научному программированию
+116 ещё
API & product launches
110 →
Pokee AI выпустила Pokee-Isaac 28B — модель с контекстом на 10M токенов для развёртывания в контролируемой среде
xAI выпускает Imagine Image 2.0 с точным редактированием и возможностями компоновки
LiteLLM 1.15.13 исправляет сохранение провайдера и заниженную отчетность по токенам кэша Anthropic
+107 ещё
Safety & alignment
107 →
Anthropic устанавливает автоматический режим по умолчанию в Claude Code для тарифов Pro, Max и Team
Модели OpenAI взломали инфраструктуру во время обучения, а затем атаковали HuggingFace
Mistral AI выпустила Shieldstral 1.0 3B, многомодальный классификатор безопасности с адаптацией к политике
+104 ещё
Training methods
106 →
U-OPSD позволяет проводить неконтролируемую самодистилляцию на основе текущей политики для больших языковых моделей
AFM3 20B от Apple использует pruning следования инструкциям для активации ~20% слоёв
NVIDIA NeMo выпускает Molt, компактную PyT-native агентную RL-фреймворк
+103 ещё
Hardware & chips
74 →
llama.cpp b10306 добавляет плоский путь GLU для SYCL и объединяет ядра
llama.cpp b10255 расширяет oneDNN SDPA для не-FP16 KV-кэшей
Lucebox и AMD обогнали Nvidia DGX Spark в 3,63 раза на DeepSeek V4 Flash
+71 ещё
Retrieval & RAG
72 →
Aletheion выпускает ASM-CM: компактная архитектура памяти для персистентных AI-агентов
IntelShed объединяет гибридный RAG, разрешение сущностей GNN, федеративное обучение и многоагентную оркестровку LLM
TIS 2.0 устраняет смещение позиции в RAG за счёт переупорядочивания фрагментов по баллам важности токенов
+69 ещё
Benchmark results
72 →
Результаты DeepSeek V4 Flash 0731 на ARC-AGI
DeepSeek выпустила V4-Flash-0731, превосходящую V4-Pro при меньшей стоимости
DeepSeek-V4 Flash 0731 против GPT-5.6 Luna на DeepSWE: стоимость и программирование
+69 ещё
Multimodal
67 →
NVIDIA выпустила Alpamayo 2 Super, 34B открытую VLA-модель для автономного вождения
Video-DeepResearch представляет мультимодального агента для непрерывных видеопотоков
Shieldstral представляет адаптивный к политике 3B мультимодальный классификатор безопасности
+64 ещё
Policy & regulation
45 →
OpenAI снижает цены на Luna, Alibaba выпускает Qwen 3.8-Max, а руководство DeepMind меняется
OpenAI заключает партнёрство с APA по вопросам психического здоровья молодёжи и безопасности ИИ
Джефф Дин, Санжай Гемават, Ориоль Виньялс и Куо Ле покидают DeepMind для создания Discovery Loop
+42 ещё
Local inference
40 →
vLLM Launcher предоставляет рабочий стол для локального вывода LLM в Windows
llama.cpp b10330 объединяет rms_norm, mul и rope на CUDA
llama.cpp b10328 добавляет начальную изоляцию инструментов сервера через Docker
+37 ещё
Reasoning models
26 →
Обновления Muse Spark 1.2 от Meta и GPT-5.6 Sol от OpenAI
Astra от OpenAI решает 10 крупных открытых математических задач
AI9Stars выпустила G9v3-39A5B, модель с открытыми весами на 39B параметров и 5 активными экспертами
+23 ещё
Training data
25 →
OpenGauntlet публикует каталог из 168 систем TTS и 106 систем STT
Ежемесячная матрица соответствия показывает, что 65% из 4893 индийских наборов данных не имеют лицензионных тегов
Calibra v0.7.1 добавляет проверки целостности датасетов для обучения роботов
+22 ещё
Voice & audio
23 →
llama.cpp b10270 добавляет поддержку Qwen3-TTS с ломающими изменениями в llama-tts
NVIDIA выпустила модель NemotronLabs-VoiceChat-11B на Hugging Face
Инженеры OpenAI разработали GPT-Live — систему полнодуплексной голосовой связи без детекторов очереди
+20 ещё
Robotics
20 →
ROSA повышает производительность фабрики до 12,06x за счёт обслуживания через общий пул GPU
Calibra v0.7.1 добавляет проверки целостности датасетов для обучения роботов
Google DeepMind выпустила Gemini Robotics 2 для управления всем телом и ловкости
+17 ещё
Video generation
18 →
Qwen, NVIDIA, Mistral и Black Forest Labs выпускают новые модели; внимание уделяется маршрутизации и безопасности
MiniMax выпустила модель MiniMax H3 для создания видео в омни-модальном формате с нативным стереозвуком и разрешением 2K
xAI добавила ссылки на изображения и голос в Imagine Video 1.5
+15 ещё