Fuente · Latent Space
media Latent Space · hace 15 d · 28 vistas

OpenAI afirma que un resultado sobre singularidad de Navier-Stokes asistido por IA se logró con 10.000 agentes

Cuentas afiliadas a OpenAI informaron que un esfuerzo asistido por IA produjo un resultado relacionado con el problema de existencia y regularidad de Navier-Stokes, uno de los Problemas del Milenio. La afirmación establece que aproximadamente 10.000 agentes colaboraron en la tarea después de ser entrenados durante aproximadamente un año utilizando aprendizaje por refuerzo multiagente.

media Latent Space · hace 20 d · 36 vistas

OpenAI lanza GPT-6 Astra, un supermodelo con capacidades de ingeniero de IA automatizado

OpenAI ha lanzado GPT-6 Astra, descrito como el primer supermodelo Stargate y ligeramente en bucle. El modelo alcanza alto rendimiento en benchmarks, saturando FrontierMath al 97.6% y ARC-AGI-3 al 99.9%. Las pruebas iniciales indican que funciona como un ingeniero de IA capaz, manejando tareas como elegir y entrenar modelos, etiquetar datos e implementar sistemas.

media Latent Space · hace 28 d · 78 vistas

OpenAI informa que el chip Jalapeño supera a NVIDIA GB200/GB300 en eficiencia y latencia

En la 37ª conferencia Hot Chips, OpenAI presentó detalles de las pruebas de rendimiento para su chip de inferencia personalizado, Jalapeño, afirmando un rendimiento superior por vatio en comparación con los sistemas GB200 y GB300 de NVIDIA. El chip entrega entre 1,5 y 1,9 veces más trabajo por vatio en el pico de rendimiento y una latencia de extremo a extremo entre 1,7 y 3,6 veces menor, con la implementación en la infraestructura de OpenAI programada para finales de año.

media Latent Space · hace 2 d · 15 vistas

TypeSafe AI presenta Jev, un modelo System One entrenado con Aprendizaje por Refuerzo para Decisiones Calibradas

TypeSafe AI ha lanzado Jev, una nueva clase de modelos "System One" diseñados para entornos de producción. El CEO de la empresa y coautor del artículo sobre InstructGPT, Diogo Almeida, argumenta que los modelos de vanguardia actuales han priorizado la alineación y las negaciones sobre la fiabilidad, lo que ha provocado problemas como alucinaciones y sycophancy.

media Latent Space · hace 9 d · 40 vistas

El estándar AEF-1 emerge para evaluadores de terceros, con el respaldo conjunto de Xai, OpenAI y Anthropic

El Foro de Evaluadores de IA ha publicado AEF-1, una propuesta de línea base para evaluaciones independientes de IA de terceros que cubren acceso, conflictos de interés, relaciones de financiación, recusación y transparencia. Este estándar surge junto a la propuesta de Dario Amodei para que las empresas de IA de vanguardia se comprometan a proporcionar acceso continuo, similar al de los empleados, a evaluadores de terceros integrados.