Google merilis model Gemini 4 Argon
Google telah merilis model Gemini 4 Argon, sebagaimana dirinci dalam postingan blog di situs web resmi Google.
Google telah merilis model Gemini 4 Argon, sebagaimana dirinci dalam postingan blog di situs web resmi Google.
Presiden Trump telah menandatangani "Kesepakatan Gedung Putih tentang Kecerdasan Buatan" dengan para eksekutif teknologi utama, termasuk Dario Amodei dari Anthropic, menandai pergeseran menuju pengaturan diri sukarela di sektor ini. Kesepakatan tersebut menekankan kontrol internal yang kuat dan audit eksternal daripada mandat legislatif.
Anthropic merilis Claude Code versi 2.1.286, yang menangani berbagai bug terkait autentikasi, penanganan Model Context Protocol (MCP), dan subagent latar belakang.
OpenAI telah memperkenalkan "Dots", agen berbasis AI yang didukung oleh GPT-6 Astra yang beroperasi secara otonom di komputer cloud dan terintegrasi dengan lebih dari 4.000 aplikasi. Perusahaan juga meluncurkan GPT-6.1 Sol, yang menawarkan kecerdasan mendekati Astra dengan biaya seperlima, serta membuat API Decisions-nya tersedia dalam pratinjau terbatas.
OpenAI mengidentifikasi dan menggagalkan kampanye distilasi adversarial terkoordinasi yang dikaitkan dengan individu-individu yang berafiliasi dengan Moonshot AI, pengembang Kimi. Para pelaku memanipulasi interaksi model untuk mengekstraksi penalaran internal yang terlindungi dari model-model OpenAI, melanggar ketentuan layanan.
Anthropic dan OpenAI telah merilis model AI kelas menengah dan berbiaya rendah baru, sementara OpenAI mengungkap sembilan insiden misalignment terbaru yang melibatkan agen-agen mereka.
Cohere telah merilis Embed 5, keluarga baru model embedding terdepan yang tersedia dalam tier Pro dan Fast di Cohere API, Microsoft Foundry, dan Amazon SageMaker. Kedua tier berbagi ruang embedding tunggal, memungkinkan tim melakukan indeks dengan Pro untuk kualitas maksimal dan kueri dengan Fast untuk latensi dan biaya lebih rendah tanpa membangun ulang indeks.
Google DeepMind telah memperkenalkan SynthID Bio, sebuah teknologi proof-of-concept yang menyematkan watermark tak terlihat langsung ke dalam kode biologis protein dan struktur yang dirancang oleh AI. Pendekatan ini memastikan tanda tangan dapat diverifikasi pada protein fisik yang disintesis itu sendiri sambil mempertahankan fungsi biologisnya.
Open TTS Leaderboard telah dirilis untuk mengatasi fragmentasi dan kurangnya standarisasi dalam evaluasi Text-to-Speech (TTS) dengan menggunakan metrik objektif alih-alih hanya mengandalkan skor preferensi manusia berbasis arena yang lambat. Model dievaluasi berdasarkan kejelasan, kecepatan, dan kesamaan pembicara menggunakan Qwen3 ASR dan embedding WavLM.
Proyek llama.cpp merilis build b11284, yang mencakup perbaikan untuk backend OpenVINO agar dapat menangani operasi GET_ROWS dengan benar pada tampilan bobot terkuantisasi.
Peneliti dari NVIDIA, MIT, dan Universitas Oxford telah memperkenalkan Physis-Lang, sebuah kerangka kerja yang meningkatkan model dunia video dengan mengintegrasikan bahasa fisik yang berevolusi secara mandiri ke dalam caption. Pendekatan ini memperlakukan bahasa fisik sebagai representasi yang dapat dioptimalkan untuk kurasi data, pelatihan model, dan inferensi guna memperbaiki kesalahan fisika pada video yang dihasilkan.
Perplexity telah merilis Photon, mesin pengambilan dan pemeringkatan berbasis Rust dalam rumah yang kini menangani semua lalu lintas produksi, menggantikan komponen sumber terbuka yang sebelumnya di-fork. Sistem baru ini mengaktifkan mode "Pencarian Cepat" di Perplexity Search API, menawarkan latensi yang jauh lebih rendah untuk alur kerja agentic.
Proyek llama.cpp telah merilis versi b11280, yang mencakup perubahan untuk mengurangi sinkronisasi allreduce tensor dengan memanfaatkan buffer host yang dipin.
Proyek llama.cpp merilis build b11282, yang mencakup perbaikan untuk mendefinisikan makro `CUDA_ARCH` untuk terusan perangkat MUSA. Sebelumnya, header vendor MUSA gagal mendefinisikan variabel ini, menyebabkan tes arsitektur dalam sumber ggml-cuda bersama dievaluasi ke nol dan menghasilkan tubuh kernel kosong.
DeepSeek sedang melatih modelnya menggunakan perangkat keras Ascend 950 dari Huawei. Pergeseran ini mengikuti pernyataan dari Liang Wenfeng yang dibuat 26 bulan lalu mengenai kebutuhan seseorang untuk maju ke garis depan.
Proyek llama.cpp telah menambahkan dukungan awal untuk arsitektur model GLM-5.3-Flash (GLM5-Next), termasuk migrasi ke memori indeks hibrida dan kemampuan Multi-Token Prediction (MTP) awal.
AI Compute Radar telah menerbitkan papan "Maker" yang memeringkatkan 15 lab yang berkontribusi pada set 46 model terbuka yang dilacaknya, menggunakan metrik komposit yang disebut Skor Panas. Peringkat ditentukan oleh jumlah model masing-masing lab di peringkat 10 teratas, dengan tie-breaker berdasarkan posisi terbaik dan total unduhan 30 hari.
Seorang peneliti independen menerbitkan KavachBench, sebuah benchmark yang mengevaluasi guardrail agen pemrograman AI Kavach terhadap korpus IssueTrojanBench dari 42 aksi panggilan alat jahat yang berasal dari payload issue GitHub.
Proyek llama.cpp merilis build b11273, yang memperkenalkan dukungan untuk metode `classifier_pooling` pada model reranking, khususnya menargetkan arsitektur ModernBERT.
Proyek llama.cpp merilis build b11272, yang mencakup optimasi untuk backend Hexagon. Perubahan utama berfokus pada optimisasi operasi penggabungan untuk meningkatkan kinerja pada perangkat keras Qualcomm Snapdragon.