Mistral AI ha anunciado la introducción de un nuevo modelo llamado Shieldstral. El contenido fuente proporciona únicamente el título y los metadatos de la publicación sin ningún detalle adicional sobre las características, capacidades o propósito del modelo.
Mistral AI presenta Shieldstral
SemGuard lanza una puerta de enlace de seguridad multilingüe con modelado semántico de triple ancla
AbdaullahAG y Somia Abufakher han lanzado SemGuard, una puerta de enlace de seguridad semántica de código abierto en cuatro capas, diseñada para proteger a los grandes modelos de lenguaje (LLM) contra inyecciones de instrucciones, eludir restricciones y fugas de privacidad en árabe, Arabizi e inglés.
Jensen Huang cita un modelo de peso abierto en el incidente de Hugging Face para lanzar la Alianza de IA Segura Abierta
El CEO de NVIDIA, Jensen Huang, declaró que un modelo de frontera de peso abierto ayudó a contener una intrusión de seguridad durante el reciente incidente de Hugging Face, mientras que los sistemas de IA cerrados bloquearon el análisis forense esencial. Citó este evento como la motivación principal para establecer la Alianza de IA Segura Abierta.
Austria implementa GovGPT para 180.000 empleados federales usando Mistral y Open WebUI
Austria está desplegando «GovGPT», una plataforma de IA gubernamental construida sobre infraestructura soberana en el centro de datos federal BRZ. El sistema utiliza modelos de peso abierto de Mistral y la interfaz Open WebUI para atender las necesidades del sector público.
Microsoft libera código verificado de ML-KEM y SHA-3 en SymCrypt usando Lean y Aeneas
Microsoft ha liberado como código abierto una rama de su biblioteca criptográfica SymCrypt que contiene especificaciones formales y pruebas para las implementaciones de Rust de ML-KEM y SHA-3. Este lanzamiento demuestra una metodología donde los algoritmos de producción se escriben en Rust seguro y se verifican contra modelos Lean derivados de estándares utilizando la cadena de herramientas Aeneas.
DeshwalX ajusta finamente Electra de 14M parámetros para la detección de inyección de prompts de baja latencia
DeshwalX ha lanzado un clasificador multietiqueta para protecciones de LLM de baja latencia, ajustando finamente el modelo `google/electra-small-discriminator` (~14M parámetros) para detectar cuatro vectores de seguridad independientes en una sola pasada hacia adelante.