A Mistral AI anunciou a introdução de um novo modelo chamado Shieldstral. O conteúdo fonte fornece apenas o título e os metadados da submissão, sem quaisquer detalhes adicionais sobre as características, capacidades ou propósito do modelo.
Mistral AI apresenta o Shieldstral
SemGuard lança gateway de segurança multilíngue com modelagem semântica de triplo âncora
AbdaullahAG e Somia Abufakher lançaram o SemGuard, um gateway de segurança semântico de quatro camadas de código aberto, projetado para proteger grandes modelos de linguagem contra injeções de prompt, jailbreaks e vazamentos de privacidade em árabe, Arabizi e inglês.
Jensen Huang cita modelo de peso aberto no incidente do Hugging Face para lançar a Aliança de IA Segura Aberta
O CEO da NVIDIA, Jensen Huang, afirmou que um modelo de fronteira de peso aberto ajudou a conter uma intrusão de segurança durante o recente incidente do Hugging Face, enquanto sistemas de IA fechados bloquearam a análise forense essencial. Ele citou esse evento como a motivação principal para estabelecer a Aliança de IA Segura Aberta.
Áustria lança GovGPT para 180.000 funcionários federais usando Mistral e Open WebUI
A Áustria está implantando o "GovGPT", uma plataforma de IA governamental construída sobre infraestrutura soberana no datacenter federal BRZ. O sistema utiliza modelos de peso aberto da Mistral e a interface Open WebUI para atender às necessidades do setor público.
Microsoft lança código verificado de ML-KEM e SHA-3 no SymCrypt usando Lean e Aeneas
A Microsoft abriu o código-fonte de um branch de sua biblioteca criptográfica SymCrypt contendo especificações formais e provas para as implementações em Rust de ML-KEM e SHA-3. Este lançamento demonstra uma metodologia onde algoritmos de produção são escritos em Rust seguro e verificados contra modelos Lean derivados de padrões usando a toolchain Aeneas.
DeshwalX faz fine-tune no Electra de 14M parâmetros para detecção de injeção de prompt de baixa latência
A DeshwalX lançou um classificador multiclasse para guardrails de LLM de baixa latência, realizando fine-tune no `google/electra-small-discriminator` (~14M parâmetros) para detectar quatro vetores de segurança independentes em uma única passagem direta.