TypeSafe AI telah meluncurkan Jev, kelas baru model "System One" yang dirancang untuk lingkungan produksi. CEO perusahaan dan co-penulis paper InstructGPT, Diogo Almeida, berpendapat bahwa model frontier saat ini lebih memprioritaskan alignment dan penolakan daripada keandalan, menyebabkan masalah seperti halusinasi dan sycophancy.

  • Jev memanfaatkan teknik pelatihan baru yang disebut Reinforcement Learning for Calibrated Decisions (RLCD), yang mengoptimalkan probabilitas yang jujur secara epistemik daripada umpan balik yang dinilai manusia atau output yang dapat diverifikasi secara terprogram.
  • Model ini bertujuan untuk "hilang ke latar belakang" perangkat lunak, berfungsi dengan andal seperti regex dalam tugas-tugas seperti penggunaan komputer, kontrol suara, dan agen pemrograman.
  • TypeSafe AI berencana merilis model-model masa depan seperti ReasoningJev, berfokus pada AI yang dapat dikomposisikan dan terprogram untuk otomatisasi daripada asisten obrolan umum.

Pendekatan ini mengatasi masalah kalibrasi yang melekat dalam metode pelatihan sebelumnya, memungkinkan Jev berfungsi sebagai fondasi yang kuat untuk alur kerja otomatis dan aplikasi perangkat pintar.