Open weights
media MarkTechPost · hace 1 d · 1 vista

Mistral AI lanza Shieldstral 1.0 3B, un clasificador de seguridad multimodal adaptable a políticas

Mistral AI ha lanzado Shieldstral 1.0 3B, un modelo de pesos abiertos que trata la moderación de contenido como una única pregunta de sí/no en lugar de depender de categorías fijas de daño. Construido sobre Ministral-3-3B-Base-2512 con un codificador visual Pixtral, permite a los operadores definir políticas mediante prompts en lenguaje natural durante la inferencia sin necesidad de reentrenamiento.

media MarkTechPost · hace 1 d

NVIDIA lanza NOOA, un marco de trabajo Python orientado a objetos para construir agentes de IA

NVIDIA Labs ha liberado como código abierto NOOA (Agentes Orientados a Objetos de NVIDIA), un marco de trabajo Python agnóstico al modelo que consolida el desarrollo de agentes en una sola clase de Python. Este enfoque reemplaza flujos de trabajo fragmentados que involucran plantillas de prompts y grafos de flujo de trabajo, mapeando métodos a acciones, campos a estado, docstrings a prompts y anotaciones de tipo a contratos forzados.

media TLDR AI · hace 2 d · 2 vistas

Google abre el código fuente de los modelos WeatherNext; Meta explora la sinergia multimodal

Google ha abierto el código fuente de sus modelos de IA WeatherNext 2 y WeatherNext Cyclones para mejorar la precisión en la predicción de ciclones. Los modelos logran resultados state-of-the-art en la predicción de trayectoria, intensidad y estructura del viento, proporcionando a los pronosticadores un día adicional promedio de precisión predictiva en comparación con los métodos actuales.

lab Google DeepMind Blog · hace 3 d · 16 vistas

Google DeepMind abre el código fuente del modelo de IA WeatherNext para la predicción de ciclones

Google DeepMind y Google Research han abierto el código fuente de los modelos de IA WeatherNext 2 y WeatherNext Cyclones, que lograron una precisión de última generación en la predicción de trayectorias, intensidad y estructura del viento de ciclones tropicales. Publicado en Nature, el trabajo demuestra que estos modelos proporcionan a los pronosticadores un día adicional de precisión predictiva en comparación con sistemas anteriores.

media Hugging Face Forums · hace 3 d · 1 vista

QuantCheck advierte contra asumir que el checkpoint final es el mejor para cuantización de 4 bits

Una nueva herramienta llamada QuantCheck destaca que el checkpoint final del preentrenamiento puede no ser la opción óptima para la cuantización de 4 bits, ya que los benchmarks pueden permanecer planos mientras aumenta la fragilidad. El autor observó este patrón en Pythia-160m, donde el checkpoint final sufrió aproximadamente cuatro veces más daño a la calidad que un checkpoint anterior de igual calidad.

media MarkTechPost · hace 4 d · 1 vista

NVIDIA lanza Alpamayo 2 Super, un modelo VLA abierto de 34B para conducción autónoma

NVIDIA ha lanzado Alpamayo 2 Super, un modelo de visión-lenguaje-acción (VLA) de 34 mil millones de parámetros diseñado para robotaxis y conducción autónoma bajo la licencia OpenMDW-1.1. El modelo aborda eventos de cola larga combinando una base Cosmos 3 Super Reasoner de 32B con un decodificador de acciones basado en difusión de 2.3B para generar trayectorias, explicaciones causales y meta-acciones a partir de video multicámara.

media AI News (smol.ai) · hace 4 d Terminal-Bench 2 · 67.4% · 8 vistas

Alibaba anuncia Qwen3.8-Max con 2.4T parámetros y pesos abiertos próximamente

Alibaba ha anunciado Qwen3.8-Max como su nuevo modelo insignia, describiéndolo como una arquitectura dispersa de 2.4T parámetros centrada en trabajo agénico de largo alcance, codificación y razonamiento multimodal. La compañía confirmó que los pesos abiertos para Qwen3.8-Max se lanzarán la próxima semana junto con la variante de pesos abiertos Qwen3.8-27B.

lab Liquid AI · hace 5 d · 5 vistas

LFM2.5-2.6B lanza un modelo agénico para dispositivo con inferencia local gratuita

Los autores publican LFM2.5-2.6B, un modelo agénico de 2.6B de parámetros diseñado para ejecutarse completamente en el dispositivo para planificación, llamada de herramientas y tareas multi-paso. Es lo suficientemente pequeño para operar en teléfonos y lo suficientemente rápido para mantenerse receptivo en CPUs, ofreciendo inferencia gratuita, baja latencia y privacidad sin dependencias de API en la nube.

lab Mistral AI News · hace 5 d · 3 vistas

Shieldstral presenta un clasificador de seguridad multimodal de 3B adaptable a políticas

Shieldstral es un clasificador de seguridad multimodal de pesos abiertos de 3B que enmarca la moderación de contenido como una tarea de respuesta a preguntas adaptable a políticas, lo que le permite aceptar políticas en lenguaje natural durante la inferencia sin necesidad de reentrenamiento. Unifica la evaluación de seguridad de texto e imágenes y proporciona puntuaciones de seguridad calibradas en diversos benchmarks mientras se ejecuta de manera eficiente en una única GPU NVIDIA de 16GB.