A TypeSafe AI lançou o Jev, uma nova classe de modelos "System One" projetados para ambientes de produção. O CEO da empresa e coautor do artigo InstructGPT, Diogo Almeida, argumenta que os modelos atuais de ponta priorizaram alinhamento e recusas em detrimento da confiabilidade, levando a problemas como alucinações e sycophancy.

  • Jev utiliza uma técnica de treinamento inovadora chamada Aprendizado por Reforço para Decisões Calibradas (RLCD), que otimiza probabilidades epistemicamente honestas em vez de feedback avaliado por humanos ou outputs verificáveis programaticamente.
  • O modelo visa "desaparecer no fundo" do software, funcionando com a mesma confiabilidade do regex em tarefas como uso de computador, controle por voz e agentes de codificação.
  • A TypeSafe AI planeja lançar modelos futuros como o ReasoningJev, focando em IA composável e programável para automação, em vez de assistentes de chat genéricos.

Essa abordagem aborda o problema de calibração inerente aos métodos de treinamento anteriores, permitindo que o Jev sirva como uma base robusta para fluxos de trabalho automatizados e aplicativos de software inteligente.