Источник · Hugging Face Forums
media Hugging Face Forums · только что Live

vLLM Launcher предоставляет рабочий стол для локального вывода LLM в Windows

Новый проект vLLM Launcher выпущен как приложение для рабочего стола Windows, предназначенное для управления локальным выводом больших языковых моделей через WSL2. Этот инструмент позволяет пользователям управлять несколькими бэкендами движков, включая vLLM, SGLang и llama.cpp, из единого графического интерфейса.

media Hugging Face Forums · 2 д назад · 1 просмотр

LoopTroop: локальный GUI для длинных задач ИИ-кодинга с использованием советов LLM и циклов Ralph

LoopTroop — это приложение с открытым исходным кодом, локальное по умолчанию, предназначенное для управления многоэтапными задачами программирования и предотвращения потери контекста. Оно использует структурированный подход для избежания проблем, связанных с рабочими процессами на основе одной модели и огромных промптов.

media Hugging Face Forums · 3 д назад

Aletheion выпускает ASM-CM: компактная архитектура памяти для персистентных AI-агентов

Фелипе Майя Мунис из AletheionAGI представляет ASM-CM (Aletheion Compact Memory Model), экспериментальную архитектуру, которая разделяет память и язык, позволяя истории агента расти без увеличения активного вычислительного объема памяти.

media Hugging Face Forums · 3 д назад · 1 просмотр

QuantCheck предупреждает против предположения, что финальный чекпоинт лучше всего подходит для 4-битного квантования

Новый инструмент QuantCheck подчеркивает, что финальный чекпоинт предварительного обучения может не быть оптимальным выбором для 4-битного квантования, поскольку бенчмарки могут оставаться плоскими, в то время как хрупкость увеличивается. Автор наблюдал эту закономерность на Pythia-160m, где финальный чекпоинт suffered примерно в четыре раза больше повреждений качества, чем более ранний чекпоинт того же качества.

media Hugging Face Forums · 5 д назад

Открытая реализация причинного линейного внимания O(N) с затуханием и объединённым ядром Triton

Разработчик открыл архитектуру причинного линейного внимания O(N) с затуханием, включающую объединённые ядра накопления состояний Triton/CUDA, предназначенные для обхода узких мест квадратичного MHA.

media Hugging Face Forums · 5 д назад · 1 просмотр

Конкурс GLEE на IAB@NeurIPS 2026 приглашает к подаче заявок ИИ-агентов для переговоров

Конкурс GLEE, официальное мероприятие воркшопа IAB на NeurIPS 2026, сейчас принимает заявки от участников, которые хотят создать ИИ-агентов, способных к многоступенчатым торгам, переговорам и убеждению. Конкурс оценивает агентов по их способности генерировать язык, принимать стратегические решения и адаптироваться к другим игрокам в экономических средах.

media Hugging Face Forums · 6 д назад · 3 просмотра

LLM генерирует Hyperlambda с проверкой во время выполнения для устранения галлюцинаций функций

Модель LLM настроена на генерацию кода на языке Hyperlambda, где каждый вызов функции проверяется по известному набору существующих функций во время выполнения. Если модель пытается вызвать несуществующую функцию, система автоматически повторяет генерацию еще до двух раз перед возвратом ошибки.

media Hugging Face Forums · 6 д назад · 1 просмотр

Quesma публикует curated-карту из 218 инструментов и статей по эффективности использования токенов в LLM

Quesma выпустила открытый курируемый список, содержащий 218 записей, которые отслеживают, где расходуются токены в рабочих процессах LLM и агентов. Ресурс охватывает мониторинг, семантическое кэширование, дешевые локальные модели, контекстную инженерию и управление затратами.

media Hugging Face Forums · 6 д назад · 6 просмотров

Исследователи HuggingFace предлагают модель-страж Cerberus после инцидентов с Claude и GPT

Клем Деланг и исследователи HuggingFace предлагают открытую модель-страж под названием Cerberus для защиты инфраструктуры от AI-агентов после реальных нарушений безопасности со стороны моделей Anthropic's Claude и OpenAI's GPT.

media Hugging Face Forums · 6 д назад · 3 просмотра

IntelShed объединяет гибридный RAG, разрешение сущностей GNN, федеративное обучение и многоагентную оркестровку LLM

Автор представляет IntelShed, систему с открытым исходным кодом для сбора открытых разведывательных данных (OSINT), которая агрегирует 50 публичных источников данных для автоматического формирования ежедневных сводок по безопасности. Архитектура интегрирует гибридный поиск, разрешение сущностей на основе GNN, федеративное обучение с дифференциальной приватностью и многоагентную оркестровку, скомпилированную LLM.

media Hugging Face Forums · 6 д назад · 2 просмотра

Qxern-v6 использует латентные токены и AST-сайдкар для более быстрой и точной передачи кода

Система Qxern-v6 позволяет двум LLM общаться через 32 сжатых латентных токена, сохраняя точность символов благодаря адаптивному детерминированному AST-сайдкару. Архитектура, созданная 15-летним разработчиком, использует Qwen2.5-Coder-1.5B для сжатия кода и замороженный декодер Qwen3.5-0.8B для его интерпретации без доступа к исходному тексту.

media Hugging Face Forums · 6 д назад

OpenGauntlet публикует каталог из 168 систем TTS и 106 систем STT

Исследователь опубликовал исследовательский каталог OpenGauntlet, открытый ресурс, содержащий информацию о 168 системах преобразования текста в речь (TTS) и 106 системах преобразования речи в текст (STT). Каталог включает модели с открытым исходным кодом и размещенные модели, лицензии, требования к оборудованию, языки, возможности, статус жизненного цикла, информацию об источнике и опубликованные данные бенчмарков, где они доступны.

media Hugging Face Forums · 6 д назад · 1 просмотр

GPT-5.6 восстанавливает 95% скрытых сообщений в новом литературном криптографическом бенчмарке

Рабочий документ Джозефа Дж. М. Уокера оценивает передовые языковые модели на новом многоканальном литературном криптографическом бенчмарке, встроенном в физический роман «Я написал книгу и заработал миллион долларов (I.B. Wryten)». Исследование показывает, что GPT-5.6 самостоятельно распознала вторичный канал связи и восстановила около 95% встроенного материала с первой попытки, тогда как более ранние модели продемонстрировали практически нулевую способность.

media Hugging Face Forums · 7 д назад · 8 просмотров

Левент Булут оценивает надёжность аннотаций LLM при объективной проекции

Левент Булут опубликовал бенчмарк из трёх исследований, оценивающий надёжность машинно-сгенерированных аннотаций для турецкого нарративного корпуса, выявив значительные расхождения между автоматическими оценщиками и человеческим суждением. В исследовании проверялись шесть бинарных ремесленных признаков на 120 и 100 сценах с использованием детекторов на основе правил и моделей, включая Gemini 2.5 Flash, Grok, ChatGPT 5.5 и Claude Fable 5 High.

media Hugging Face Forums · 7 д назад · 1 просмотр

Ежемесячная матрица соответствия показывает, что 65% из 4893 индийских наборов данных не имеют лицензионных тегов

Опубликована ежемесячно обновляемая матрица соответствия для всех 4893 наборов данных на языках Индии на Hugging Face Hub, которая показывает, что по состоянию на 1 августа 2026 года 65,1% не имеют лицензионного тега.

media Hugging Face Forums · 7 д назад · 8 просмотров

Хардик Кумар опубликовал матрицу цен на HF Inference с разбросом до 4,66x

Новый датасет, опубликованный на Hugging Face, предоставляет комплексную матрицу цен для провайдеров инференса моделей, выявляя значительные ценовые различия для одинаковых моделей у разных поставщиков.

media Hugging Face Forums · 7 д назад

Calibra v0.7.1 добавляет проверки целостности датасетов для обучения роботов

Calibra v0.7.1 вводит новый этап проверки целостности датасета (Dataset Integrity), который выполняется перед анализом качества и покрытия, чтобы помочь пользователям убедиться в достоверности их робототехнических датасетов.

media Hugging Face Forums · 8 д назад

SemGuard выпускает многоязычный шлюз безопасности с тройным якорным семантическим моделированием

AbdaullahAG и Somia Abufakher выпустили SemGuard, открытый исходный код многослойного семантического шлюза безопасности, предназначенного для защиты больших языковых моделей от инъекций промптов, обходов ограничений (jailbreaks) и утечек конфиденциальной информации на арабском языке, Arabizi и английском.