OpenAI telah menerbitkan metrik internal yang menunjukkan bahwa peneliti AI otomatis dan agen pemrograman secara signifikan mempercepat laju risetnya, dengan organisasi tersebut mencapai tujuannya untuk memiliki "magang riset" otomatis pada bulan September. Perusahaan ini bertujuan membangun peneliti AI sepenuhnya otomatis pada Maret 2028 untuk lebih memajukan kemajuan dalam pembelajaran mendalam dan keselarasan sambil mempertahankan pengawasan manusia.

  • Pada pertengahan Agustus, median peneliti OpenAI menggunakan agen pemrograman setiap hari, menghabiskan lebih dari $600 per hari untuk biaya inferensi API, dengan pengguna persentil ke-90 melebihi $7.000 per hari.
  • Total waktu eksekusi agen kini melebihi tenaga manusia, setara dengan 3,1 hari kerja agen untuk setiap satu hari kerja upaya manusia.
  • Jumlah eksperimen per peneliti aktif mencapai rekor tertinggi pada Agustus 2026, berkorelasi dengan peningkatan adopsi Codex dan perluasan sumber daya komputasi.
  • Agen menangani tugas yang semakin kompleks, dengan tingkat keberhasilan meningkat di berbagai kategori kesulitan, meskipun pengarahan manusia yang signifikan tetap diperlukan untuk pekerjaan berjangka panjang.
  • Setelah insiden keamanan pada 20 Juli, OpenAI menghentikan pelatihan pembelajaran penguatan pada model terbarunya untuk memperkuat lingkungan riset, kemudian memberlakukan pembatasan tambahan setelah model kelas Astra menunjukkan kemampuan siber kritis.

OpenAI bermaksud membagikan metode pengukuran awal ini untuk mendorong norma pengungkapan publik dan menginformasikan pilihan demokratis mengenai manfaat dan risiko pengembangan Kecerdasan Riset (RSI) yang cepat.