Open weights
media MarkTechPost · 1 hari lalu · 1 tayangan

Mistral AI merilis Shieldstral 1.0 3B, pengklasifikasi keamanan multimodal yang adaptif terhadap kebijakan

Mistral AI telah merilis Shieldstral 1.0 3B, model open-weights yang memperlakukan moderasi konten sebagai pertanyaan ya/tidak tunggal alih-alih mengandalkan kategori bahaya tetap. Dibangun di atas Ministral-3-3B-Base-2512 dengan encoder visi Pixtral, model ini memungkinkan operator mendefinisikan kebijakan melalui prompt bahasa alami pada saat inferensi tanpa perlu pelatihan ulang.

media MarkTechPost · 1 hari lalu

NVIDIA merilis NOOA, kerangka kerja Python berorientasi objek untuk membangun agen AI

NVIDIA Labs telah membuka sumber NOOA (NVIDIA Object-Oriented Agents), sebuah kerangka kerja Python yang agnostik terhadap model dan mengonsolidasikan pengembangan agen ke dalam satu kelas Python. Pendekatan ini menggantikan alur kerja terfragmentasi yang melibatkan templat prompt dan grafik alur kerja dengan memetakan metode ke tindakan, bidang ke keadaan, docstring ke prompt, dan anotasi tipe ke kontrak yang ditegakkan.

lab Google DeepMind Blog · 3 hari lalu · 16 tayangan

Google DeepMind merilis model AI WeatherNext untuk prakiraan siklon secara sumber terbuka

Google DeepMind dan Google Research telah merilis model AI WeatherNext 2 dan WeatherNext Cyclones secara sumber terbuka, yang mencapai akurasi terbaik dalam memprediksi lintasan, intensitas, dan struktur angin siklon tropis. Dipublikasikan di Nature, penelitian ini menunjukkan bahwa model-model ini memberikan prakirawan tambahan satu hari akurasi prediktif dibandingkan sistem sebelumnya.

media Hugging Face Forums · 3 hari lalu · 1 tayangan

QuantCheck memperingatkan untuk tidak mengasumsikan checkpoint akhir adalah yang terbaik untuk kuantisasi 4-bit

Sebuah alat baru bernama QuantCheck menyoroti bahwa checkpoint akhir pra-pelatihan mungkin bukan pilihan optimal untuk kuantisasi 4-bit, karena benchmark dapat tetap datar sementara kerapuhan meningkat. Penulis mengamati pola ini pada Pythia-160m, di mana checkpoint akhir mengalami sekitar empat kali lebih banyak kerusakan kualitas dibandingkan checkpoint sebelumnya dengan kualitas yang sama.

media MarkTechPost · 4 hari lalu · 1 tayangan

NVIDIA merilis Alpamayo 2 Super, model VLA terbuka 34B untuk pengemudi otonom

NVIDIA telah merilis Alpamayo 2 Super, model visi-bahasa-aksi (VLA) dengan 34 miliar parameter yang dirancang untuk robotaxi dan pengemudi otonom di bawah lisensi OpenMDW-1.1. Model ini menargetkan peristiwa ekor panjang dengan menggabungkan tulang punggung Cosmos 3 Super Reasoner berukuran 32B dengan decoder aksi berbasis difusi berukuran 2,3B untuk menghasilkan lintasan, penjelasan kausal, dan meta-aksi dari video multi-kamera.

media AI News (smol.ai) · 4 hari lalu Terminal-Bench 2 · 67.4% · 8 tayangan

Alibaba mengumumkan Qwen3.8-Max dengan 2.4T parameter dan bobot terbuka yang akan datang

Alibaba telah mengumumkan Qwen3.8-Max sebagai model andalan barunya, menggambarkannya sebagai arsitektur sparse 2.4T-parameter yang berfokus pada pekerjaan agentic jangka panjang, pemrograman, dan penalaran multimodal. Perusahaan mengonfirmasi bahwa bobot terbuka untuk Qwen3.8-Max akan dirilis minggu depan bersama varian open-weight Qwen3.8-27B.

lab Mistral AI News · 5 hari lalu · 3 tayangan

Shieldstral memperkenalkan pengklasifikasi keamanan multimodal 3B yang adaptif terhadap kebijakan

Shieldstral adalah pengklasifikasi keamanan multimodal open-weights 3B yang membingkai moderasi konten sebagai tugas penjawab pertanyaan yang adaptif terhadap kebijakan, sehingga memungkinkan penerimaan kebijakan dalam bahasa alami pada saat inferensi tanpa pelatihan ulang. Model ini menyatukan evaluasi keamanan teks dan gambar serta memberikan skor keamanan terkalibrasi di berbagai benchmark sambil berjalan secara efisien pada satu GPU NVIDIA 16GB.