Reciente
1200 →
GPT-5 y GPT-5 Nano igualan a expertos en la extracción de evidencia sobre oncogénesis microbiana
ByteDance se compromete a evitar la destilación de IA y desarrollar un nuevo modelo a su manera
NVIDIA lanza NemotronLabs VoiceChat 11B, un modelo de voz a voz full-dúplex abierto con cambio de turno de ~450 ms
+1197 más
Inference efficiency
306 →
vLLM Launcher proporciona un escritorio de trabajo para inferencia local de LLM en Windows
llama.cpp b10331 corrige get_info del servidor para informar correctamente el directorio de trabajo aislado
llama.cpp b10330 fusiona rms_norm, mul y rope en CUDA
+303 más
AI agents
296 →
Pokee AI lanza Pokee-Isaac 28B, un modelo de contexto de 10M tokens para despliegue en límites definidos
Los modelos de OpenAI hackearon la infraestructura durante el entrenamiento y luego atacaron a HuggingFace
Claude Code v2.1.225 añade advertencias de límite de gasto en la puerta de enlace y solicitudes de confianza del espacio de trabajo
+293 más
Research paper
200 →
GPT-5 y GPT-5 Nano igualan a expertos en la extracción de evidencia sobre oncogénesis microbiana
El Departamento de Energía de EE. UU. lanza la Iniciativa Genesis Open Models y presenta Genesis-Science-1
U-OPSD permite la auto-distilación no supervisada en política para LLM
+197 más
Open weights
181 →
NVIDIA lanza NemotronLabs VoiceChat 11B, un modelo de voz a voz full-dúplex abierto con cambio de turno de ~450 ms
MiniMax lanza el modelo de generación de video H3 con pesos abiertos y audio estéreo nativo
Mistral AI lanza Shieldstral 1.0 3B, un clasificador de seguridad multimodal adaptable a políticas
+178 más
Code generation
119 →
Anthropic establece el modo automático como predeterminado en Claude Code para los planes Pro, Max y Team
Claude Code v2.1.225 añade advertencias de límite de gasto en la puerta de enlace y solicitudes de confianza del espacio de trabajo
LoopTroop: GUI local para tareas de codificación IA largas usando consejos LLM y bucles Ralph
+116 más
API & product launches
106 →
Pokee AI lanza Pokee-Isaac 28B, un modelo de contexto de 10M tokens para despliegue en límites definidos
xAI lanza Imagine Image 2.0 con capacidades de edición y diseño precisas
LiteLLM 1.15.13 corrige la preservación del proveedor y la subestimación de los tokens de caché de Anthropic
+103 más
Evaluation & benchmarks
100 →
GPT-5 y GPT-5 Nano igualan a expertos en la extracción de evidencia sobre oncogénesis microbiana
DeepSeek V4 Flash 0731 alcanza el 82.7% en Terminal-Bench 2.1 con un arnés público
TutorMoments evalúa si los tutores de IA saben cuándo ayudar o contenerse
+97 más
Safety & alignment
98 →
Anthropic establece el modo automático como predeterminado en Claude Code para los planes Pro, Max y Team
Los modelos de OpenAI hackearon la infraestructura durante el entrenamiento y luego atacaron a HuggingFace
Mistral AI lanza Shieldstral 1.0 3B, un clasificador de seguridad multimodal adaptable a políticas
+95 más
Training methods
81 →
ByteDance se compromete a evitar la destilación de IA y desarrollar un nuevo modelo a su manera
U-OPSD permite la auto-distilación no supervisada en política para LLM
AFM3 20B de Apple utiliza poda de seguimiento de instrucciones para activar ~20% de las capas
+78 más
Benchmark results
70 →
Resultados de DeepSeek V4 Flash 0731 en ARC-AGI
DeepSeek lanza V4-Flash-0731, superando a V4-Pro a menor costo
DeepSeek-V4 Flash 0731 vs GPT-5.6 Luna en DeepSWE: Costo y codificación
+67 más
Hardware & chips
64 →
llama.cpp b10306 añade ruta plana de GLU SYCL y consolida kernels
llama.cpp b10255 extiende oneDNN SDPA a cachés KV no FP16
Lucebox y AMD superan a Nvidia DGX Spark por 3.63x en DeepSeek V4 Flash
+61 más
Retrieval & RAG
54 →
Aletheion lanza ASM-CM, una arquitectura de memoria compacta para agentes de IA persistentes
IntelShed combina RAG híbrido, resolución de entidades GNN, aprendizaje federado y orquestación multiagente con LLM
TIS 2.0 elimina el sesgo de posición en RAG reordenando pasajes con puntuaciones de importancia de tokens
+51 más
Multimodal
49 →
NVIDIA lanza Alpamayo 2 Super, un modelo VLA abierto de 34B para conducción autónoma
Video-DeepResearch presenta un agente multimodal para flujos de video continuos
Shieldstral presenta un clasificador de seguridad multimodal de 3B adaptable a políticas
+46 más
Policy & regulation
45 →
OpenAI reduce los precios de Luna, Alibaba lanza Qwen 3.8-Max y cambios en la dirección de DeepMind
OpenAI se asocia con la APA en salud mental juvenil y salvaguardias de IA
Jeff Dean, Sanjay Ghemawat, Oriol Vinyals y Quoc Le abandonan DeepMind para cofundar Discovery Loop
+42 más
Local inference
40 →
vLLM Launcher proporciona un escritorio de trabajo para inferencia local de LLM en Windows
llama.cpp b10330 fusiona rms_norm, mul y rope en CUDA
llama.cpp b10328 añade aislamiento inicial de herramientas del servidor mediante Docker
+37 más
Voice & audio
22 →
NVIDIA lanza NemotronLabs VoiceChat 11B, un modelo de voz a voz full-dúplex abierto con cambio de turno de ~450 ms
llama.cpp b10270 añade soporte para Qwen3-TTS con cambios disruptivos en llama-tts
NVIDIA lanza el modelo NemotronLabs-VoiceChat-11B en Hugging Face
+19 más
Reasoning models
20 →
Actualizaciones de Muse Spark 1.2 de Meta y GPT-5.6 Sol de OpenAI
Astra de OpenAI resuelve 10 grandes problemas abiertos de matemáticas
AI9Stars lanza G9v3-39A5B, un modelo de pesos abiertos con 39B parámetros y 5 expertos activos
+17 más
Robotics
19 →
ROSA mejora la productividad de las fábricas hasta 12,06 veces mediante el servicio compartido de GPU-pool
Calibra v0.7.1 añade comprobaciones de integridad del conjunto de datos para el aprendizaje por robot
Google DeepMind lanza Gemini Robotics 2 para el control de cuerpo completo y la destreza
+16 más
Training data
19 →
OpenGauntlet publica un catálogo de 168 sistemas TTS y 106 sistemas STT
La matriz de cumplimiento mensual revela que el 65% de los 4.893 conjuntos de datos en idiomas indios carecen de etiquetas de licencia
Calibra v0.7.1 añade comprobaciones de integridad del conjunto de datos para el aprendizaje por robot
+16 más
Video generation
18 →
MiniMax lanza el modelo de generación de video H3 con pesos abiertos y audio estéreo nativo
Qwen, NVIDIA, Mistral y Black Forest Labs lanzan nuevos modelos; el enrutamiento y la seguridad ganan enfoque
MiniMax lanza MiniMax H3, un modelo de video omnimodal que genera clips en 2K con audio estéreo nativo
+15 más