Mistral AI объявила о выпуске новой модели под названием Shieldstral. Исходный контент содержит только заголовок и метаданные публикации без каких-либо дополнительных сведений о функциях, возможностях или назначении модели.
Mistral AI представляет Shieldstral
SemGuard выпускает многоязычный шлюз безопасности с тройным якорным семантическим моделированием
AbdaullahAG и Somia Abufakher выпустили SemGuard, открытый исходный код многослойного семантического шлюза безопасности, предназначенного для защиты больших языковых моделей от инъекций промптов, обходов ограничений (jailbreaks) и утечек конфиденциальной информации на арабском языке, Arabizi и английском.
Дженсен Хуанг ссылается на модель с открытым весом в инциденте Hugging Face для запуска Альянса по обеспечению безопасности ИИ
Генеральный директор NVIDIA Дженсен Хуанг заявил, что модель с открытым весом помогла сдержать вторжение в систему безопасности во время недавнего инцидента на платформе Hugging Face, тогда как закрытые системы ИИ блокировали необходимый анализ следов. Он назвал это событие главной причиной создания Альянса по обеспечению безопасности ИИ.
Австрия внедряет GovGPT для 180 000 федеральных сотрудников с использованием Mistral и Open WebUI
Австрия развертывает «GovGPT», государственную ИИ-платформу, построенную на суверенной инфраструктуре в федеральном дата-центре BRZ. Система использует модели Mistral с открытым весом и интерфейс Open WebUI для удовлетворения потребностей государственного сектора.
Microsoft выпустила проверенный код ML-KEM и SHA-3 в SymCrypt с использованием Lean и Aeneas
Microsoft открыла исходный код ветки своей криптографической библиотеки SymCrypt, содержащей формальные спецификации и доказательства для реализаций ML-KEM и SHA-3 на Rust. Этот релиз демонстрирует методологию, при которой производственные алгоритмы пишутся на безопасном Rust и проверяются против моделей Lean, полученных из стандартов, с использованием инструментария Aeneas.
DeshwalX выполняет тонкую настройку Electra с 14 млн параметров для обнаружения инъекций промптов с низкой задержкой
DeshwalX выпустил многоклассификатор для защитных механизмов LLM с низкой задержкой, выполнив тонкую настройку модели `google/electra-small-discriminator` (~14 млн параметров) для обнаружения четырех независимых векторов безопасности в одном прямом проходе.