Mistral AI a annoncé l'introduction d'un nouveau modèle appelé Shieldstral. Le contenu source fournit uniquement le titre et les métadonnées de la soumission, sans aucun détail supplémentaire sur les fonctionnalités, les capacités ou l'objectif du modèle.
Mistral AI présente Shieldstral
SemGuard publie une passerelle de sécurité multilingue avec modélisation sémantique à triple ancre
AbdaullahAG et Somia Abufakher ont publié SemGuard, une passerelle de sécurité sémantique open-source à quatre couches conçue pour protéger les grands modèles de langage contre les injections d'invite, les contournements de sécurité et les fuites de confidentialité en arabe, Arabizi et anglais.
Jensen Huang cite un modèle à poids ouvert dans l'incident Hugging Face pour lancer l'Alliance IA Sécurisée Ouverte
Le PDG de NVIDIA, Jensen Huang, a déclaré qu'un modèle de pointe à poids ouvert a aidé à contenir une intrusion de sécurité lors du récent incident de Hugging Face, tandis que les systèmes d'IA fermés ont bloqué l'analyse forensique essentielle. Il a cité cet événement comme la motivation principale pour établir l'Alliance IA Sécurisée Ouverte.
L'Autriche déploie GovGPT pour 180 000 fonctionnaires fédéraux en utilisant Mistral et Open WebUI
L'Autriche déploie « GovGPT », une plateforme d'IA gouvernementale construite sur une infrastructure souveraine au centre de données fédéral BRZ. Le système utilise des modèles à poids ouvert de Mistral et l'interface Open WebUI pour répondre aux besoins du secteur public.
Microsoft publie du code vérifié pour ML-KEM et SHA-3 dans SymCrypt en utilisant Lean et Aeneas
Microsoft a open-sourcé une branche de sa bibliothèque cryptographique SymCrypt contenant des spécifications formelles et des preuves pour les implémentations Rust de ML-KEM et SHA-3. Cette publication démontre une méthodologie où les algorithmes de production sont écrits en Rust sûr et vérifiés contre des modèles Lean dérivés des normes à l'aide de la chaîne d'outils Aeneas.
DeshwalX affine les 14M de paramètres d'Electra pour la détection d'injection de prompt à faible latence
DeshwalX a publié un classificateur multi-étiquettes pour les garde-fous LLM à faible latence, en affinant le modèle `google/electra-small-discriminator` d'environ 14M de paramètres pour détecter quatre vecteurs de sécurité indépendants en un seul passage avant.