Laboratorio · Perplexity
media Latent Space · hace 28 d · 78 vistas

OpenAI informa que el chip Jalapeño supera a NVIDIA GB200/GB300 en eficiencia y latencia

En la 37ª conferencia Hot Chips, OpenAI presentó detalles de las pruebas de rendimiento para su chip de inferencia personalizado, Jalapeño, afirmando un rendimiento superior por vatio en comparación con los sistemas GB200 y GB300 de NVIDIA. El chip entrega entre 1,5 y 1,9 veces más trabajo por vatio en el pico de rendimiento y una latencia de extremo a extremo entre 1,7 y 3,6 veces menor, con la implementación en la infraestructura de OpenAI programada para finales de año.

media MarkTechPost · hace 22 d · 40 vistas

Perplexity lanza computación híbrida en Mac con filtrado de PII en el dispositivo

Perplexity ha lanzado una función de computación híbrida para Mac que divide las tareas agentivas entre modelos fronterizos en la nube y modelos locales, utilizando un filtro de privacidad en el dispositivo para manejar datos sensibles. Esto permite a los usuarios aprovechar el potente razonamiento en la nube mientras mantiene archivos privados como documentos de acuerdos o registros de clientes estrictamente en su hardware.

media MarkTechPost · hace 29 d · 55 vistas

Perplexity lanza Portable Computer en NVIDIA DGX Spark con un entorno de agentes locales

Perplexity ha lanzado Portable Computer, una versión local-first de su plataforma agéntica que ejecuta el entorno del agente, orquestador, planificador, enrutador de herramientas y modelos post-entrenados directamente en hardware NVIDIA DGX Spark. Este sistema empaquetado permite que cada tarea comience en el dispositivo, sin cobrar por token para el trabajo manejado por modelos locales, mientras escala solo pasos específicos a más de 15 modelos en la nube con la aprobación del usuario.