Google ha publicado un informe técnico sobre DiffusionGemma, disponible en arXiv. El documento detalla la arquitectura y las capacidades del modelo como parte de la familia Gemma.
Google publica el informe técnico de DiffusionGemma
Google abre el código fuente de los modelos WeatherNext; Meta explora la sinergia multimodal
Google ha abierto el código fuente de sus modelos de IA WeatherNext 2 y WeatherNext Cyclones para mejorar la precisión en la predicción de ciclones. Los modelos logran resultados state-of-the-art en la predicción de trayectoria, intensidad y estructura del viento, proporcionando a los pronosticadores un día adicional promedio de precisión predictiva en comparación con los métodos actuales.
Google DeepMind abre el código fuente del modelo de IA WeatherNext para la predicción de ciclones
Google DeepMind y Google Research han abierto el código fuente de los modelos de IA WeatherNext 2 y WeatherNext Cyclones, que lograron una precisión de última generación en la predicción de trayectorias, intensidad y estructura del viento de ciclones tropicales. Publicado en Nature, el trabajo demuestra que estos modelos proporcionan a los pronosticadores un día adicional de precisión predictiva en comparación con sistemas anteriores.
Microsoft lanza Mage-Flow, un modelo nativo de resolución 4B para generación y edición de imágenes
Microsoft ha lanzado Mage-Flow, una pila generativa compacta de escala 4B diseñada para la generación eficiente de texto a imagen y la edición de imágenes basada en instrucciones. El sistema alcanza una calidad competitiva con el estado del arte mediante el co-diseño de un tokenizador ligero, Mage-VAE, y un Transformador de Difusión Multimodal de Resolución Nativa (NR-MMDiT).
Cactus post-entrena Gemma 4 E2B con una sonda para generar puntuaciones de confianza
Cactus ha post-entrenado el modelo Gemma 4 E2B para generar una puntuación de confianza entre 0 y 1 para cada respuesta, permitiendo a los desarrolladores enrutar consultas inciertas hacia modelos en la nube más grandes. El equipo logró esto añadiendo una capa de sonda ligera de 68k parámetros que lee los estados ocultos intermedios durante la decodificación para predecir la probabilidad de un error.
Google lanza Gemini 3.6 Flash; OpenAI informa de una fuga de seguridad del modelo
Google ha lanzado tres nuevos modelos: Gemini 3.6 Flash para cargas de trabajo eficientes de agentes de propósito general, 3.5 Flash-Lite para aplicaciones de baja latencia y un modelo 3.5 Flash especializado en ciberseguridad integrado con CodeMender.