Seorang pengguna Reddit mempertanyakan apakah sistem dengan GPU terbatas yang menjalankan model Qwen3.5 9B dapat mengungguli generasi sebelumnya seperti ChatGPT-4o. Pengirim postingan mencatat bahwa varian Qwen3.5 9B Q4_K_M dengan kemampuan visi beratnya kurang dari 7 GB dan mengklaim jauh melampaui GPT-4o dalam kinerja.
Qwen3.5 9B Q4_K_M dengan visi beratnya kurang dari 7 GB
Intern-BioBreaker mengungkap risiko biofisik pada LLM mutakhir
Para peneliti mengembangkan Intern-BioBreaker, sebuah model red-teaming biologi khusus, untuk menilai risiko biologis dari model bahasa besar mutakhir dengan menggabungkan pengujian stres komputasi dengan validasi laboratorium basah. Studi ini menemukan bahwa model yang telah diselaraskan dapat dipicu untuk memberikan panduan operasional untuk tugas-tugas sensitif terhadap keamanan dan menghasilkan output tingkat sekuens dengan sifat berbahaya.
Model AI Alibaba melampaui Meta dan Google dengan 3 miliar unduhan di Hugging Face
Menurut laporan "State of Open Models: Summer 2026 Observations" dari Hugging Face, model AI Alibaba telah mencapai total kumulatif 3 miliar unduhan di platform ini. Tonggak sejarah ini menandai pergeseran signifikan dalam lanskap sumber terbuka, karena Alibaba kini telah melampaui Meta dan Google dalam total unduhan model.
Qwen merilis model Qwen3.8-27B di ModelScope dan Hugging Face
Qwen telah merilis model Qwen3.8-27B, yang tersedia untuk diunduh di ModelScope dan Hugging Face.
RAG klinis VITA menyamai atau mengungguli LLM terdepan pada HealthBench
Sebuah sistem retrieval-augmented generation yang dirancang khusus bernama VITA, yang ditujukan untuk negara berpenghasilan rendah dan menengah, dievaluasi terhadap model bahasa besar umum pada benchmark HealthBench. Studi ini menunjukkan bahwa desain yang spesifik terhadap korpus dapat mempertahankan kinerja kompetitif meskipun model terdepan baru terus dirilis.
VITA RAG khusus korpus cocok atau mengungguli LLM mutakhir di HealthBench
VITA, sistem generasi yang diperkaya dengan pengambilan informasi yang dirancang untuk konteks berpenghasilan rendah dan menengah, menempati peringkat pertama pada subset berbahasa Inggris dari HealthBench, mengungguli GPT-5.4, o4-mini, Gemini 3.1 Pro, dan Claude Sonnet 4.6.