Basis, sebuah perusahaan agen AI untuk akuntan, mengevaluasi GPT-6 Astra dari OpenAI terhadap GPT-5.6 Sol pada tugas buku kerja pajak kompleks dengan 50 tab. Uji menunjukkan bahwa GPT-6 Astra menyelesaikan pekerjaan dalam setengah waktu dan menunjukkan pemahaman yang lebih mendalam tentang maksud pengguna.
- GPT-6 Astra membutuhkan waktu 50% lebih sedikit untuk menyelesaikan buku kerja 50 tab dibandingkan dengan GPT-5.6 Sol.
- Basis mengamati peningkatan sekitar 20% dalam skor evaluasi internal, didorong oleh pengenalan maksud yang lebih baik.
- Model secara dinamis menyesuaikan komputasi penalaran berdasarkan kesulitan tugas sambil mempertahankan cache-nya.
- GPT-6 Astra dapat menyimpulkan harapan dari konteks yang lebih luas, mengurangi kebutuhan akan aturan eksplisit.
Penyesuaian dinamis penalaran membantu mengurangi biaya dan waktu respons, membuat tugas jangka panjang lebih ekonomis bagi Basis dan pelanggannya.