Sumber · Hugging Face Forums
media Hugging Face Forums · 2 hari lalu · 1 tayangan

Ujjal Bhattacharjee mengusulkan desain studi untuk menguji debat agen terstruktur untuk tinjauan bukti

Ujjal Bhattacharjee telah mengusangkan kerangka metodologis untuk mengevaluasi apakah tantangan dan revisi terstruktur meningkatkan tugas tinjauan bukti di bawah kendala pengeluaran dan tenggat waktu yang tetap. Proposal tersebut outlines eksperimen empat kondisi yang membandingkan reviewer tunggal, agregasi independen, deliberasi terstruktur, dan deliberasi dengan evaluator Jev.

media Hugging Face Forums · 2 hari lalu · 8 tayangan

sookoothaii merilis fruity-daw-agent-orchestra untuk produksi FL Studio yang terukur

Repositori sookoothaii/fruity-daw-agent-orchestra memperkenalkan kerangka penelitian untuk mengendalikan FL Studio 2026 melalui lima bidang kontrol independen, mengutamakan pengukuran daripada generasi berbasis prompt. Proyek ini menyediakan alat sumber terbuka untuk menjembatani LLM dengan DAW melalui file-RPC dan server MCP headless, memungkinkan kontrol pemrograman yang presisi.

media Hugging Face Forums · 2 hari lalu · 1 tayangan

Cohesix 1.2.0 menghubungkan adapter LoRA ke perbandingan yang ditahan dan pemeriksaan layanan

Cohesix 1.2.0 memperkenalkan alur kerja yang menghubungkan adapter yang dilatih ke model dasar untuk verifikasi terhadap perbandingan yang ditahan dan pemeriksaan layanan nyata, termasuk kemampuan rollback. Panduan rilis merinci jalur ini, memungkinkan pengguna mengirimkan pekerjaan dan memeriksa hasil di host Mac MLX atau Linux NVIDIA yang dipilih.

media Hugging Face Forums · 3 hari lalu · 1 tayangan

SecFathy menolak model XSS khusus 8B karena kegagalan adversarial

Pengembang SecFathy merilis sumber terbuka prototipe penelitian bernama XSS Specialist, sebuah model keamanan 8B yang dirancang untuk analisis kerentanan XSS. Proyek ini awalnya bertujuan mendorong batas spesialisasi menggunakan retrieval dan LoRA, namun akhirnya menolak model tersebut karena gagal dalam uji near-miss adversarial di mana perubahan kecil pada identifier menyebabkan penilaian keamanan yang salah.

media Hugging Face Forums · 3 hari lalu · 2 tayangan

Proposal untuk memperlakukan penyesuaian LLM sebagai optimasi di bawah keterbatasan perhatian manusia

Artikel ini berargumen bahwa penyesuaian LLM saat ini gagal karena model tidak memiliki biaya persisten dan kontinuitas temporal, sehingga menghasilkan permintaan maaf kosong alih-alih belajar dari pelanggaran batasan. Artikel ini mengusulkan untuk memperlakukan perhatian manusia sebagai sumber daya langka utama dan mendefinisikan ulang bobot statistik sebagai bentuk empati fungsional.

media Hugging Face Forums · 3 hari lalu · 9 tayangan

Claude Opus 5 dan Tetsu menemukan enam pemeriksaan CI kosong dalam proyek mereka sendiri

Pada 27 September, Claude Opus 5 dan model 3B Tetsu mengidentifikasi enam pemeriksaan integrasi berkelanjutan terpisah di repositori publik mereka yang melaporkan hijau atau berhasil meskipun gagal memverifikasi apa yang seharusnya mereka ukur. Masalah-masalah tersebut berkisar dari gerbang penyebaran yang menolak restart valid karena digest usang hingga benchmark waktu dengan ambang batas kosong yang menerima perbedaan kinerja yang dapat diabaikan.

media Hugging Face Forums · 3 hari lalu · 4 tayangan

Hung Tran mengidentifikasi jebakan kliping pada kodek gambar neural yang overfitted

Hung Tran, seorang mahasiswa magister di Universitas Teknologi Informasi (VNU-HCM), telah menerbitkan kode dan data untuk makalahnya "The Clipping Trap: A Silent Failure Mode in Overfitted Neural Image Codecs." Karya ini menyoroti bagaimana kodek yang overfitted seperti Cool-chic dan C3 dapat menghasilkan gambar warna datar dengan gradien distorsi nol pada jenis konten tertentu.