Lab · Zhipu AI
media r/LocalLLaMA · 1 hari lalu · 1 tayangan

Riset Anthropic menghubungkan GLM-5 dengan penyebaran kemampuan siber canggih

Anthropic menerbitkan artikel penelitian berjudul "GLM-5.3 dan Penyebaran Kemampuan Siber Canggih", yang memeriksa bagaimana model open-source seperti GLM-5 digunakan dalam aktivitas siber jahat. Artikel tersebut menyoroti bahwa model-model ini telah diadopsi secara luas oleh aktor ancaman, secara efektif berfungsi sebagai iklan untuk kemampuan mereka di komunitas keamanan. Analisis ini menekankan kekhawatiran yang meningkat mengenai sifat penggunaan ganda dari model AI canggih dan potensi mereka untuk memperkuat ancaman siber.

arxiv arXiv cs.CL · 2 hari lalu · 1 tayangan

Studi mengungkap divergensi kebijakan epistemik dalam kontaminasi LLM multi-giliran

Sebuah studi berjudul "Divergensi Kebijakan Epistemik dalam Kontaminasi LLM Multi-Giliran: Investigasi Gradien Protokol" mengevaluasi bagaimana model bahasa besar menangani premis palsu yang disuntikkan ke dalam riwayat percakapan, sebuah mode kegagalan yang disebut kontaminasi tingkat sesi. Para peneliti menguji GPT-5.4 Mini, Gemini-3.1 Flash-Lite, dan GLM-4.5-Air di sepuluh domain pengetahuan menggunakan 22.500 giliran pada suhu nol.

arxiv arXiv cs.CL · 8 hari lalu · 19 tayangan

TelecomGPT-R1: Pelatihan Pasca-Unifikasi untuk Penalaran Melintasi Tugas Telekomunikasi Heterogen

Para peneliti memperkenalkan TelecomGPT-R1, sebuah keluarga model penalaran telekomunikasi terpadu sumber terbuka yang dirancang untuk mengotomatisasi tugas teknik dengan menalar atas standar, konfigurasi, dan log. Model ini mengatasi keterbatasan LLM umum dan khusus yang ada melalui pendekatan terstruktur yang mencakup aspek protokol, pengetahuan, pemodelan, dan gangguan.

arxiv arXiv cs.LG · 9 hari lalu HealthBench · 50.1% · 13 tayangan

Fathom-Vaidya meningkatkan penalaran medis dengan hadiah berbasis rubrik

Para penulis memperkenalkan Fathom-Vaidya, model 30B parameter yang menggunakan data sintetis dan pembelajaran penguatan berbasis rubrik untuk meningkatkan penalaran diagnostik dan klinis dalam perawatan kesehatan. Kerangka pelatihan pertama-tama menerapkan RL yang dipandu aturan pada pertanyaan yang berasal dari MedBullets untuk diagnosis, kemudian memanfaatkan 5.3k skenario multi-giliran sintetis dengan rubrik multidimensi untuk tugas klinis interaktif.

arxiv arXiv cs.CL · 14 hari lalu · 24 tayangan

Model frontier dievaluasi pada permainan log(N)-Questions di atas Wikipedia

Sebuah studi mengevaluasi enam model bahasa frontier pada tugas komunikasi dua agen di mana penanya mengidentifikasi target dari N paragraf Wikipedia menggunakan tepat log2(N) pertanyaan ya/tidak. Eksperimen ini menjalankan 408 permainan di atas kumpulan dokumen berukuran 4 hingga 1024 paragraf, yang mengungkapkan disparitas kinerja signifikan di antara model-model yang diuji.

arxiv arXiv cs.CL · 21 hari lalu · 33 tayangan

Serangan satu arah pada GLM-5.3-Flash mengungkap kerapuhan penyesuaian keamanan pada model MoE

Peneliti menunjukkan bahwa ablasi berarah, sebuah serangan kotak-putih yang menghilangkan penolakan dengan memproyeksikan keluar satu arah dari bobot, tetap efektif pada model campuran-ahli (MoE) terdepan seperti GLM-5.3-Flash. Studi ini menunjukkan bahwa meskipun serangan bertahan terhadap arsitektur, efeknya terdistribusi di seluruh penulis perhatian, padat, dan ahli yang dialihkan, bukan terkonsentrasi di satu lokasi.