Lab · xAI
lab xAI News · 13 hari lalu · 30 tayangan

xAI merilis Grok Voice Transcribe 2.0 dengan akurasi dua kali lipat dari v1

xAI telah merilis Grok Voice Transcribe 2.0, sebuah model suara-ke-teks yang dua kali lebih akurat dibandingkan versi 1.0 sambil mempertahankan harga yang sama. Dibangun di atas model dasar audio di balik Grok Voice, model ini memanfaatkan dataset unik audio multibahasa langsung dan bising untuk menangani kondisi dunia nyata yang menantang seperti jalur telepon yang tidak stabil dan suara yang bersaing.

lab xAI News · 9 hari lalu · 28 tayangan

SpaceXAI menggunakan Grok Bot untuk menangani lonjakan tiket sebesar 175% tanpa merekrut

SpaceXAI mengintegrasikan agen AI Grok Bot-nya ke dalam operasi dukungan pelanggan gabungan setelah akuisisi Cursor, memungkinkan tim mengelola peningkatan tiket dukungan sebesar 175% tanpa menambah jumlah karyawan. Perusahaan menghindari perekrutan sekitar 200 anggota staf tambahan dan mengurangi biaya penyelesaian menjadi antara $0,20 hingga $0,30 per tiket dengan memanfaatkan model harga berbasis penggunaan Grok Bot.

lab xAI News · 27 hari lalu · 50 tayangan

Bot Tawar-menawar xAI mengidentifikasi penghematan pengadaan lebih dari $100.000

xAI telah mengerahkan agen otonom bernama "Haggle Bot" untuk mengelola tugas pengadaan perusahaan, berhasil mengidentifikasi penghematan langsung lebih dari $100.000 dengan menganalisis pengeluaran vendor, kontrak, dan data penggunaan. Bot ini beroperasi dengan akses ke alat seperti Slack, Notion, Ramp, dan Gmail, memungkinkannya melakukan audit langganan SaaS, menegosiasikan perpanjangan, dan mengoptimalkan pembelian berulang tanpa intervensi manusia langkah demi langkah.

media MarkTechPost · 9 hari lalu GDPval-AA (Elo) · 1695.0Elo · 24 tayangan

SpaceXAI merilis Grok 4.7 dengan model dasar lebih besar dan peningkatan benchmark

SpaceXAI telah merilis Grok 4.7, model andalan baru untuk pemrograman, tugas agentic, dan kerja pengetahuan yang memanfaatkan model dasar lebih besar dan durasi pelatihan penguatan (reinforcement learning) lebih panjang dibandingkan Grok 4.6. Model ini mempertahankan struktur harga yang sama dengan pendahulunya sambil menawarkan kemampuan yang ditingkatkan dalam verifikasi diri, penanganan konteks panjang, dan keamanan.

media MarkTechPost · 18 hari lalu · 40 tayangan

Anthropic mengusulkan rencana 'Pace the Frontier' dengan evaluator tersemat

Pada 12 September 2026, CEO Anthropic Dario Amodei menerbitkan esai berjudul 'We Must Pace the Frontier,' yang menyerukan perlambatan peningkatan kemampuan AI. Proposal ini mencakup rencana tiga langkah: membentuk 'evaluator tersemat' pihak ketiga dengan akses tingkat karyawan ke pipeline pelatihan, mengoordinasikan standar keamanan di antara lab frontier, dan mengejar perjanjian global mengenai batas-batas AI.

media Latent Space · 17 hari lalu · 45 tayangan

Standar AEF-1 muncul untuk Penilai Pihak Ketiga, ditandatangani bersama oleh Xai, OpenAI, dan Anthropic

Forum Penilai AI telah menerbitkan AEF-1, sebuah usulan garis dasar untuk evaluasi AI pihak ketiga independen yang mencakup akses, konflik kepentingan, hubungan pendanaan, penarikan diri, dan transparansi. Standar ini muncul seiring dengan proposal Dario Amodei agar perusahaan AI frontier berkomitmen memberikan akses berkelanjutan bagi penilai pihak ketiga yang terintegrasi, setara dengan karyawan.