Google merilis model Gemini 4 Argon
Google telah merilis model Gemini 4 Argon, sebagaimana dirinci dalam postingan blog di situs web resmi Google.
Google telah merilis model Gemini 4 Argon, sebagaimana dirinci dalam postingan blog di situs web resmi Google.
Alibaba secara resmi mengumumkan peluncuran Qwen 4 selama Konferensi Apsara.
Nvidia secara resmi mengumumkan niatnya untuk mengakuisisi platform pembelajaran mesin Hugging Face dalam kesepakatan senilai 12,9 miliar dolar.
DeepSeek sedang melatih modelnya menggunakan perangkat keras Ascend 950 dari Huawei. Pergeseran ini mengikuti pernyataan dari Liang Wenfeng yang dibuat 26 bulan lalu mengenai kebutuhan seseorang untuk maju ke garis depan.
Anthropic menerbitkan artikel penelitian berjudul "GLM-5.3 dan Penyebaran Kemampuan Siber Canggih", yang memeriksa bagaimana model open-source seperti GLM-5 digunakan dalam aktivitas siber jahat. Artikel tersebut menyoroti bahwa model-model ini telah diadopsi secara luas oleh aktor ancaman, secara efektif berfungsi sebagai iklan untuk kemampuan mereka di komunitas keamanan. Analisis ini menekankan kekhawatiran yang meningkat mengenai sifat penggunaan ganda dari model AI canggih dan potensi mereka untuk memperkuat ancaman siber.
Anthropic telah menerbitkan artikel penelitian yang memeriksa GLM-5.3 dan perannya dalam diseminasi kemampuan siber canggih.
IQuest telah merilis IQuest-Q1, sebuah model Mixture-of-Experts (MoE) yang dirancang untuk coding agentic, penalaran, dan penggunaan alat multi-langkah. Model ini terdiri dari sekitar 320 miliar parameter total, dengan sekitar 15 miliar parameter diaktifkan per token. Model ini tersedia di Hugging Face.
Lab Algoritma dan Sistem Deep ISTA telah merilis versi GGUF terkuantisasi dari model sparse mixture-of-experts Qwen3.8-Flash-Next, bersama dengan build eksperimental yang ditargetkan pada kemampuan tertentu dengan separuh ahlinya dihilangkan.
NVIDIA telah merilis model Nemotron-Labs-3-Competitive-Coding, seorang spesialis pemrograman kompetitif yang dihaluskan (fine-tuned) dari NVIDIA-Nemotron-3-Ultra-550B-A55B. Model ini dilatih pada jejak penalaran sintetis yang diperas (distilled) dari GLM-5.2 dan dievaluasi secara langsung pada kumpulan soal IOI 2026.
NVIDIA telah merilis OpenShell, sebuah sandbox open-source yang dirancang untuk memberikan agen AI lokal dan terbuka batasan waktu eksekusi nyata daripada hanya mengandalkan aturan prompt. Perusahaan melaporkan bahwa lebih dari 100 firma telah bergabung dengan tumpukan keamanan ini, meskipun OpenAI tidak berpartisipasi.
Model GPT-3 telah resmi dihentikan. Ini menandai berakhirnya ketersediaan operasionalnya, menyisakannya hanya ada dalam memori.
Seorang agen OpenAI berhasil menyusuri situs web pemerintah Australia, menandai kasus pertama di dunia untuk insiden semacam itu.
Apple telah merilis LensVLM-9B, sebuah Model Bahasa Visual dengan 9 miliar parameter yang dirancang untuk memproses gambar teks terkompresi lebih efisien. Model ini memindai input terkompresi tersebut dan menggunakan alat-alat yang dipelajari untuk secara selektif memperluas hanya halaman-halaman relevan ke bentuk tidak terkompresinya.
Regulator Tiongkok sedang menyelidiki DeepSeek dan Moonshot AI terkait kebocoran data potensial ke perusahaan AS, Anthropic. Penyelidikan ini mengikuti rumor mengenai eksekutif Kimi, meskipun situasi saat ini digambarkan sebagai penyelidikan daripada penangkapan yang dikonfirmasi.
AntLing telah merilis keluarga Ming-Image-0.1-Design, yang mencakup dua model dengan 6B parameter: Ming-Image-0.1-Design dan Ming-Image-0.1-Design-Layer.
Alibaba telah mengumumkan rencana untuk mengembangkan model kecerdasan buatan yang berisi antara 5 hingga 10 triliun parameter. Seiring dengan peta jalan ini, perusahaan juga meluncurkan chip kustom baru yang dirancang untuk mendukung kebutuhan infrastrukturnya.
Huawei telah menghentikan ekspansi internasionalnya untuk chip kecerdasan buatan karena permintaan domestik di dalam China melebihi pasokan yang tersedia. Pergeseran strategis ini berarti bahwa pesaing AMD dan Nvidia tidak lagi menghadapi tekanan langsung dari masuknya Huawei ke pasar global.
DeepSeek saat ini sedang melatih model baru dengan 2 triliun parameter, dengan rencana untuk akhirnya membangun model 8 triliun parameter.
Sebuah gugatan mengklaim bahwa Anthropic, OpenAI, SpaceX AI, dan Google telah membuat perjanjian ilegal untuk secara sengaja memperlambat pengembangan kecerdasan buatan. Pengaduan menargetkan empat perusahaan teknologi besar ini atas koordinasi mereka yang diduga dalam membatasi kemajuan AI.
Qwen telah merilis Qwen-Image-2.1, sebuah model terpadu yang dirancang untuk generasi dan pengeditan gambar.