GPT-5.5 Instant meningkatkan respons kesehatan dan kesejahteraan ChatGPT melalui penalaran yang lebih kuat, penanganan konteks yang lebih baik, komunikasi yang lebih jelas, serta evaluasi berdasarkan informasi dari dokter.
GPT-5.5 Instant Meningkatkan Respons Kesehatan ChatGPT
Sistem Buddy: Monitor entropi Rust dengan ketidakpastian gerbang NER untuk inferensi LLM bertingkat
Sistem Buddy menggunakan monitor entropi Rust untuk mendeteksi ketidakpastian per-token dalam inferensi Gemma 3 4B lokal, mengalihkan hanya token yang tidak pasti ke Sonnet melalui ekstraksi rentang gerbang NER dan pengambilan semantik. Benchmark menunjukkan mencapai akurasi 71,4% pada $0,21, mengungguli pola Anthropic Advisor (62,9% pada $0,44) di tujuh dataset Hugging Face, dengan peningkatan kunci pada SQuAD v2 dengan mengalihkan potongan passage sumber ke model cloud.
Anthropic merilis Claude Opus 4 dan Sonnet 4 dengan penalaran hibrida
Anthropic telah merilis dua model bahasa besar baru, Claude Opus 4 dan Claude Sonnet 4, yang memperkenalkan kemampuan "penalaran hibrida" untuk menggabungkan respons cepat dengan pemikiran bertahap yang lebih panjang. Model-model ini menggantikan generasi Claude 3.x dan mempertahankan jendela konteks 200.000 token sambil menawarkan peningkatan keamanan dan kemampuan agentic.
Google merilis model penalaran Gemini 2.5 Pro eksperimental dengan konteks 1M token
Google telah merilis Gemini 2.5 Pro, model pertamanya dalam keluarga Gemini 2.5 dan model penalaran paling mampu hingga saat ini. Model ini memiliki jendela konteks input 1 juta token (dengan rencana ekspansi), mendukung input multimodal termasuk teks, gambar, audio, dan video, serta saat ini tersedia melalui paket Gemini Advanced dan Google AI Studio.
xAI merilis Grok-1.5 dengan penalaran yang ditingkatkan dan konteks 128K
xAI telah mengumumkan Grok-1.5, sebuah model baru yang memiliki kemampuan penalaran yang ditingkatkan dan jendela konteks hingga 128.000 token. Model ini akan tersedia untuk penguji awal dan pengguna yang ada di platform 𝕏 dalam beberapa hari mendatang.
TelecomGPT-R1: Pelatihan Pasca-Unifikasi untuk Penalaran Melintasi Tugas Telekomunikasi Heterogen
Para peneliti memperkenalkan TelecomGPT-R1, sebuah keluarga model penalaran telekomunikasi terpadu sumber terbuka yang dirancang untuk mengotomatisasi tugas teknik dengan menalar atas standar, konfigurasi, dan log. Model ini mengatasi keterbatasan LLM umum dan khusus yang ada melalui pendekatan terstruktur yang mencakup aspek protokol, pengetahuan, pemodelan, dan gangguan.