Mistral AIは、Shieldstralという名前の新モデルの導入を発表しました。ソースコンテンツにはタイトルと提出メタデータのみが含まれており、モデルの機能、能力、または目的に関する追加の詳細は一切提供されていません。
Mistral AIがShieldstralを発表
SemGuardが三重アンカー意味モデリングを備えた多言語セキュリティゲートウェイをリリース
AbdaullahAGとSomia Abufakherは、アラビア語、Arabizi、英語におけるプロンプトインジェクション、ジャイルブレイク、プライバシー漏洩から大規模言語モデルを保護するために設計されたオープンソースの4層型意味セキュリティゲートウェイであるSemGuardをリリースしました。
ジェンセン・ファンがHugging Faceのインシデントでオープンウェイトモデルを引用し、Open Secure AI Allianceを立ち上げ
NVIDIAのCEOであるジェンセン・ファンは、最近のHugging Faceのインシデント中にオープンウェイトのフロンティアモデルがセキュリティ侵入の封じ込めに役立ったと述べ、一方クローズドなAIシステムは必要な forensic 分析をブロックしたと語った。彼はこの出来事をOpen Secure AI Alliance設立の主要な動機として挙げた。
オーストリア、MistralとOpen WebUIを使用して18万人の連邦職員向けGovGPTを展開
オーストリアは、BRZ連邦データセンターの主権インフラストラクチャ上に構築された政府用AIプラットフォーム「GovGPT」を展開しています。このシステムは、MistralオープンウェイトモデルとOpen WebUIインターフェースを利用して、公共部門のニーズに対応します。
Microsoft、LeanとAeneasを用いたSymCryptでML-KEMおよびSHA-3の検証済みコードを公開
Microsoftは、ML-KEMおよびSHA-3のRust実装に対する形式仕様と証明を含む、その暗号化ライブラリであるSymCryptのブランチをオープンソースとして公開しました。このリリースは、本番環境のアルゴリズムを安全なRustで記述し、Aeneasツールチェーンを使用してLeanモデル(標準から派生)に対して検証するという手法を示しています。
DeshwalXが低遅延のプロンプトインジェクション検出のために14MパラメータのElectraをファインチューニング
DeshwalXは、低遅延のLLMガードレール用のマルチラベル分類器をリリースしました。これは単一フォワードパスで4つの独立した安全ベクトルを検出するために、約14Mパラメータの `google/electra-small-discriminator` をファインチューニングしています。