Peneliti di Cymela yang menyelidiki penalaran ruang laten kontinu dengan model Monarch Chrysalis v1 mengamati mode kegagalan spesifik di mana representasi internal model tidak membantu generasi secara efektif. Meskipun uji kausal mengonfirmasi bahwa vektor laten jelas spesifik terhadap pertanyaan dan bervariasi secara substansial antar prompt, mentransplantasikan keadaan ini antar masalah menunjukkan bahwa kualitas jawaban hampir tidak berubah.

  • Decoder downstream tampaknya tidak sensitif terhadap informasi spesifik tugas yang ada di saluran laten.
  • Tim telah mengidentifikasi masalah arsitektur dan pelatihan sejak checkpoint awal dan sedang menjalankan arsitektur yang direvisi.
  • Checkpoint publik untuk model hyper-3b-latent dirilis bersama temuan tersebut.

Para penulis tidak mengklaim bahwa mekanisme tersebut berfungsi saat ini dan menahan klaim lebih lanjut hingga jalankan saat ini menentukan apakah perubahan arsitektur menyelesaikan masalah.