Tim Qwen telah merilis model Qwen3.8-Flash-Next, yang kini tersedia di ModelScope.
Rilis ini memperkenalkan varian baru dalam seri Qwen3.8-Flash.
Tim Qwen telah merilis model Qwen3.8-Flash-Next, yang kini tersedia di ModelScope.
Rilis ini memperkenalkan varian baru dalam seri Qwen3.8-Flash.
Ant Group telah membuka sumber kode Ling-3.0-flash-Fin, model pertama dalam keluarga Ant Ling dengan kemampuan keuangan yang ditingkatkan, yang dikembangkan bersama institusi keuangan terkemuka dan pakar domain.
Alibaba telah merilis versi yang ditingkatkan dari model bahasa besarnya, Qwen3.8-Max-0902. Model baru ini memiliki 2,4 triliun parameter dan mendukung jendela konteks sebesar 1 juta token.
Berita AI minggu ini menyoroti rilis model bobot terbuka yang signifikan dari Z.ai, Tencent, dan Alibaba, bersamaan dengan perkembangan dalam infrastruktur inferensi dan benchmarking agen.
Tim Qwen Alibaba telah merilis Qwen3.8-Flash-Next, model Mixture-of-Experts multimodal berbobot terbuka yang dirancang untuk mendahului arsitektur seri Qwen4 mendatang. Titik pemeriksaan ini menggabungkan tulang punggung 125B dengan tabel embedding N-gram 51B dan modul prediksi multi-token 4B, mengaktifkan hanya 6B parameter per token.
Para penulis memperkenalkan Quantization-Aware Healing (QAH), sebuah pipa yang mendistilasi siswa 4-bit langsung dari model tanpa kompresi untuk memulihkan kinerja yang hilang selama kompresi struktural dan kuantisasi. Diterapkan pada GPT-OSS 120B, metode ini menghasilkan Hypernova-60B, yang menyamai atau mengalahkan sumber bfloat16 pada 7 dari 9 benchmark sambil menggunakan sekitar 4 kali lebih sedikit memori bobot.
Kami menggunakan cookie untuk mengukur lalu lintas dan meningkatkan situs. Anda dapat menerima atau menolak cookie analitik. Kebijakan privasi