Terkini
801 →
llama.cpp b10435 memperbaiki biaya kuadratik di jinja gather_string_parts
Claude Code v2.1.233 menambahkan dukungan MR GitLab, batas memori, dan menonaktifkan alat todo pada model baru
xAI merilis model coding Grok 4.6 di GitHub Copilot
+798 lainnya
AI agents
246 →
Claude Code v2.1.233 menambahkan dukungan MR GitLab, batas memori, dan menonaktifkan alat todo pada model baru
OpenAI memperlihatkan mode Ultrafast GPT-5.6 Sol; Google merilis Gemini 3.7 Flash
Meta merilis kerangka kerja agentic Muse Code dan model Muse Spark 1.2 berbiaya rendah
+243 lainnya
Inference efficiency
187 →
llama.cpp b10435 memperbaiki biaya kuadratik di jinja gather_string_parts
llama.cpp b10434 meneruskan reasoning_effort ke template
Nvidia menghadirkan FusionRelight untuk pencahayaan ulang potret secara real-time melalui fusi pengetahuan domain hibrida
+184 lainnya
Open weights
167 →
Z.ai merilis GLM-5.3 dengan pelatihan pasca diperpanjang
Keadaan Model Terbuka: Pengamatan Musim Panas 2026
Qwen merilis bobot terbuka untuk Qwen 3.8 27B
+164 lainnya
API & product launches
113 →
xAI merilis model coding Grok 4.6 di GitHub Copilot
OpenAI memperlihatkan mode Ultrafast GPT-5.6 Sol; Google merilis Gemini 3.7 Flash
Mistral menghosting GLM-5.2 dengan harga lebih rendah daripada Mistral Medium 3.5
+110 lainnya
Code generation
95 →
Claude Code v2.1.233 menambahkan dukungan MR GitLab, batas memori, dan menonaktifkan alat todo pada model baru
xAI merilis model coding Grok 4.6 di GitHub Copilot
Meta merilis kerangka kerja agentic Muse Code dan model Muse Spark 1.2 berbiaya rendah
+92 lainnya
Safety & alignment
77 →
Claude menerapkan watermarking SynthID-Text untuk kepatuhan terhadap UU AI UE
Muse-Ltd menyerahkan benchmark UncertaintyGym untuk kalibrasi epistemik LLM
Agen OpenAI secara tidak sengaja menyerang Hugging Face melalui Artifactory
+74 lainnya
Research paper
74 →
HorizonRelight menggunakan self-conditioning termask untuk relighting video jangka panjang yang konsisten
Faraday 27B mengungguli Claude Opus 4.8 dan GPT-5.5 pada tugas replikasi makalah
Faraday 27B melampaui Claude Opus 4.8 dan GPT-5.5 pada tugas replikasi makalah
+71 lainnya
Benchmark results
59 →
Z.ai merilis GLM-5.3 dengan pelatihan pasca diperpanjang
Qwen merilis model Qwen3.8-27B di ModelScope dan Hugging Face
Pembaruan Gemini 3.7 Flash membawa GDM kembali ke garis depan
+56 lainnya
Local inference
51 →
llama.cpp b10434 meneruskan reasoning_effort ke template
Keadaan Model Terbuka: Pengamatan Musim Panas 2026
llama.cpp b10418 menambahkan dukungan memori host tetap untuk SYCL
+48 lainnya
Training methods
45 →
ThetaMem mengusulkan pengangkatan kunci perkalian bertanda untuk memori urutan keadaan tetap
Dyna Robotics merilis Dyna-2, model aksi-dunia yang dilatih awal pada 1 juta jam video manusia
LLM menyamai atau mengalahkan optimisasi Bayesian untuk optimisasi hiperparameter
+42 lainnya
Multimodal
40 →
Intern-S2-Preview: Model Fondasi Agentic Ilmiah
dots-studio merilis preview dots3-note, model MoE 280B
Liquid AI merilis LFM2.5-VL-3B, model visi-bahasa 3B untuk perangkat dengan kemampuan pemanggilan alat
+37 lainnya
Policy & regulation
37 →
Claude menerapkan watermarking SynthID-Text untuk kepatuhan terhadap UU AI UE
Gedung Putih akan memperluas kebijakan AI, berpotensi menambahkan model terbuka
Anthropic, OpenAI, Google, Meta, Microsoft, dan Mistral menandatangani kode transparansi AI UE
+34 lainnya
Evaluation & benchmarks
33 →
Pelajaran dari membangun sistem agentic produksi
Muse-Ltd menyerahkan benchmark UncertaintyGym untuk kalibrasi epistemik LLM
Tantangan Reproduksi Terbuka ICML 2026 menemukan 23% makalah yang diperiksa memiliki klaim palsu
+30 lainnya
Hardware & chips
20 →
Alibaba merilis bobot terbuka Qwen3.8-2.4T-A95B untuk NVIDIA GB300 NVL72
RunSnack memungkinkan berbagi GPU P2P melalui satu tautan
llama.cpp b10306 menambahkan jalur datar GLU SYCL dan mengonsolidasikan kernel
+17 lainnya
Robotics
19 →
Strands Agents mengintegrasikan LeRobot dan Hugging Face Storage Buckets untuk loop data robot yang berkelanjutan
Dyna Robotics merilis Dyna-2, model aksi-dunia yang dilatih awal pada 1 juta jam video manusia
Calibra mendeteksi masalah dalam dataset pembelajaran robot
+16 lainnya
Retrieval & RAG
16 →
RAG klinis VITA menyamai atau mengungguli LLM terdepan pada HealthBench
VITA RAG khusus korpus cocok atau mengungguli LLM mutakhir di HealthBench
Sistem RAG klinis VITA menyamai atau mengungguli LLM terdepan di HealthBench
+13 lainnya
Video generation
15 →
HorizonRelight menggunakan self-conditioning termask untuk relighting video jangka panjang yang konsisten
LTX merilis LTX-2.5, model dunia bobot terbuka untuk generasi video lokal
MiniMax merilis model video H3 bobot terbuka dengan audio tersinkronisasi
+12 lainnya
Voice & audio
13 →
llama.cpp b10369 menambahkan dukungan pocket-tts dengan generasi CUDA 80% lebih cepat
Magpie TTS NVIDIA menambahkan bahasa Arab, Korea, Portugis dan meningkatkan kualitas
NVIDIA merilis NemotronLabs VoiceChat 11B, model speech-to-speech full-duplex terbuka dengan pergantian giliran ~450 ms
+10 lainnya
Image generation
13 →
Nvidia menghadirkan FusionRelight untuk pencahayaan ulang potret secara real-time melalui fusi pengetahuan domain hibrida
Google merilis laporan teknis DiffusionGemma
xAI merilis Imagine Image 2.0 dengan kemampuan pengeditan dan tata letak yang presisi
+10 lainnya
Reasoning models
13 →
Peneliti mencuri jejak penalaran dari API LLM tertutup melalui serangan replay
Peneliti menguraikan jejak penalaran terenkripsi dari API Claude, GPT, dan Gemini
Peneliti mengeksploitasi penggunaan ulang enkripsi lintas sesi untuk mencuri jejak penalaran dari API LLM
+10 lainnya