Mistral AI 宣布推出一款名为 Shieldstral 的新模型。源内容仅提供标题和提交元数据,未提供有关该模型功能、能力或用途的任何其他详细信息。
media
r/LocalLLaMA
·
3 小时前
·
open_models
Mistral AI 推出 Shieldstral
译自 English → 中文
相关文章
media
Hugging Face Forums
·
3 天前
SemGuard 发布具有三重锚点语义建模的多语言安全网关
AbdaullahAG 和 Somia Abufakher 发布了 SemGuard,这是一个开源的四层语义安全网关,旨在保护大型语言模型免受阿拉伯语、Arabizi 和英语中的提示注入、越狱和隐私泄露。
media
r/LocalLLaMA
·
8 天前
·
1 次浏览
黄仁勋在Hugging Face事件中引用开放权重模型,发起开放安全AI联盟
NVIDIA首席执行官黄仁勋表示,一个开放权重的前沿模型帮助遏制了近期Hugging Face事件中的安全入侵,而封闭的AI系统则阻碍了必要的取证分析。他将此事件作为建立开放安全AI联盟的主要动机。
media
r/LocalLLaMA
·
13 天前
奥地利使用 Mistral 和 Open WebUI 为 18 万联邦员工推出 GovGPT
奥地利正在部署“GovGPT”,这是一个基于 BRZ 联邦数据中心主权基础设施构建的政府 AI 平台。该系统利用 Mistral 开源权重模型和 Open WebUI 界面来满足公共部门的需求。
lab
Microsoft Research Blog
·
22 天前
·
1 次浏览
Microsoft 使用 Lean 和 Aeneas 在 SymCrypt 中发布经过验证的 ML-KEM 和 SHA-3 代码
Microsoft 已开源其 SymCrypt 密码库的一个分支,其中包含 ML-KEM 和 SHA-3 的 Rust 实现的正式规范和证明。此次发布展示了一种方法论,即生产级算法使用安全的 Rust 编写,并使用 Aeneas 工具链针对源自标准的 Lean 模型进行验证。
media
Hugging Face Forums
·
23 天前
·
1 次浏览
DeshwalX 对具有 1400 万参数的 Electra 进行微调,以实现低延迟提示注入检测
DeshwalX 发布了一个用于低延迟 LLM 护栏的多标签分类器,通过对 `google/electra-small-discriminator`(约 1400 万参数)进行微调,在一次前向传播中检测四个独立的安全向量。