Tema · Hardware & chips
lab Anthropic News · hace 28 d · 90 vistas

Anthropic abre la vista previa de investigación del Estándar de Hardware de Modelos para el control de dispositivos de agentes de IA

Anthropic y el Campus de Investigación HHMI Janelia han abierto una vista previa de investigación del Estándar de Hardware de Modelos (MHS), una especificación compartida diseñada para permitir que los agentes de IA operen con seguridad dispositivos físicos en laboratorios e instalaciones de fabricación. El estándar reduce el tiempo de integración de hardware de semanas o meses a horas al proporcionar un controlador unificado que traduce entre sistemas operativos e interfaces de hardware diversas.

lab NVIDIA Research · hace 8 d · 17 vistas

ShareMMU permite el intercambio seguro de traducción de direcciones entre aceleradores no confiables con baja sobrecarga

Los investigadores presentan ShareMMU, un diseño de IOMMU que permite a múltiples aceleradores no confiables reutilizar de forma segura direcciones previamente traducidas dentro de un espacio de direcciones virtuales compartido. Este enfoque mitiga los riesgos de canales laterales asociados con grandes búferes de traducción compartidos (TLB) mientras mantiene un alto rendimiento.

lab NVIDIA Research · hace 13 d · 24 vistas

NVIDIA lanza GPIR para la recuperación privada de información acelerada por GPU

Investigadores de NVIDIA han presentado GPIR, un sistema que acelera la Recuperación Privada de Información (PIR) en GPUs abordando la alta computación y el tráfico de memoria en el lado del servidor inherentes a los protocolos basados en retículas. El sistema emplea un modelo de ejecución híbrido consciente de las etapas que cambia dinámicamente entre kernels a nivel de operación y a nivel de etapa para maximizar la reutilización de datos en el chip.

lab NVIDIA Research · hace 13 d · 24 vistas

NVIDIA caracteriza el rendimiento y costo de MPC y FHE para PPML

Un nuevo estudio presenta una caracterización unificada a nivel de sistema de la computación multipartita segura (MPC) y la criptografía totalmente homomórfica (FHE) para inferencia de aprendizaje automático que preserva la privacidad. El trabajo evalúa dos variantes de MPC —conversión de compartición aritmética/binaria y compartición secreta de funciones— junto con FHE en múltiples modelos CNN y Transformer.

lab OpenAI News · hace 16 d · 41 vistas

El Sol GPT-5.6 de MIT automatiza la calibración de chips cuánticos mediante Codex

Beatriz Yankelevich del Grupo de Sistemas Cuánticos de Ingeniería de MIT utilizó GPT‑5.6 Sol, integrado con Codex, para ejecutar y refinar automáticamente mediciones rutinarias en qubits superconductores. Esta integración permite que el agente de IA opere el software de laboratorio, analice los resultados y decida sobre los pasos siguientes sin supervisión humana constante.

lab NVIDIA Research · hace 26 d · 31 vistas

Twill deriva automáticamente horarios óptimos de software pipelining y especialización de warp para GPUs con Tensor Cores

Los investigadores han presentado Twill, un sistema que formula el software pipelining (SWP) y la especialización de warp (WS) como un problema de optimización conjunta resoluble por solucionadores de restricciones comerciales. Este enfoque automatiza la derivación de horarios óptimos de ejecución para programas iterativos en arquitecturas GPU.

media Latent Space · hace 28 d · 78 vistas

OpenAI informa que el chip Jalapeño supera a NVIDIA GB200/GB300 en eficiencia y latencia

En la 37ª conferencia Hot Chips, OpenAI presentó detalles de las pruebas de rendimiento para su chip de inferencia personalizado, Jalapeño, afirmando un rendimiento superior por vatio en comparación con los sistemas GB200 y GB300 de NVIDIA. El chip entrega entre 1,5 y 1,9 veces más trabajo por vatio en el pico de rendimiento y una latencia de extremo a extremo entre 1,7 y 3,6 veces menor, con la implementación en la infraestructura de OpenAI programada para finales de año.

media Latent Space · hace 2 h

Meta Connect 2026 presenta el agente personal Muse, gafas de RV y llavero Charm

En Meta Connect 2026, Meta presentó su agente personal Muse como el centro de una estrategia de hardware más agente, introduciendo nuevas características y dispositivos mientras anticipaba un modelo de vanguardia futuro. La empresa mostró las capacidades expandidas de Muse, incluidas interacciones por voz y video en tiempo real, junto con nuevo hardware como gafas de RV y el llavero Charm.

github llama.cpp · hace 8 d · 20 vistas

llama.cpp b10994 corrige NaN de Metal en mul_mm_id para activaciones grandes

La versión llama.cpp b10994 incluye una corrección para el backend de Metal que resuelve las salidas NaN en la operación `mul_mm_id` cuando los valores de activación superan el rango f16. Este defecto anteriormente hacía que modelos como Mistral Small 4 produjeran vocabularios completamente NaN durante los pasos de prellenado de 32 tokens o más en dispositivos Apple Silicon.

media Hugging Face Forums · hace 12 d · 14 vistas

Propuesta de un entorno de ejecución de IA independiente del proveedor con gestión de memoria consciente

Una propuesta en los foros de Hugging Face describe una capa común de ejecución y gestión de memoria para GPU, diseñada para desacoplar el código de la aplicación de proveedores específicos de hardware como NVIDIA, AMD e Intel. El objetivo es permitir a los usuarios especificar un presupuesto de memoria en lugar de configurar manualmente indicadores específicos del backend, mapas de dispositivos o estrategias de descarga.