TypeSafe AI ha lanzado Jev, una nueva clase de modelos "System One" diseñados para entornos de producción. El CEO de la empresa y coautor del artículo sobre InstructGPT, Diogo Almeida, argumenta que los modelos de vanguardia actuales han priorizado la alineación y las negaciones sobre la fiabilidad, lo que ha provocado problemas como alucinaciones y sycophancy.
- Jev utiliza una técnica de entrenamiento novedosa llamada Aprendizaje por Refuerzo para Decisiones Calibradas (RLCD), que optimiza probabilidades epistémicamente honestas en lugar de retroalimentación calificada por humanos o salidas verificables programáticamente.
- El modelo tiene como objetivo "desaparecer en el fondo" del software, funcionando con la misma fiabilidad que regex en tareas como uso de computadoras, control por voz y agentes de codificación.
- TypeSafe AI planea lanzar futuros modelos como ReasoningJev, centrados en IA componible y programable para automatización en lugar de asistentes de chat genéricos.
Este enfoque aborda el problema de calibración inherente a los métodos de entrenamiento anteriores, permitiendo que Jev sirva como una base sólida para flujos de trabajo automatizados y aplicaciones de software inteligente.