Laporan Teknis Solar Open 2 memperkenalkan Solar Open 2, model bahasa Mixture-of-Experts berukuran 250B-A15B yang dirancang untuk tugas agentic berjangka panjang. Model ini mencapai jendela konteks 1M-token melalui tumpukan perhatian hibrida dan dilatih menggunakan inisialisasi efisien dari Solar Open 1 serta data bernilai tinggi yang dikurasi.
- Model ini memanfaatkan mekanisme perhatian hibrida dengan satu lapisan softmax di antara setiap tiga lapisan linear-attention, tanpa menggunakan encoding posisi dan aturan delta gated yang diperluas ke nilai eigen negatif.
- Efisiensi pelatihan dicapai dengan menginisialisasi dari kerangka bersama Solar Open 1 dan menyempurnakan kumpulan data 20T menjadi campuran 10T melalui kurasi yang sadar akan kualitas dan kelangkaan.
- Keterampilan agen dikonsolidasikan dari dua belas spesialis domain menggunakan Distilasi On-Policy Multi-guru (MOPD).
- Solar Open 2 memimpin model bobot terbuka berukuran sebanding pada MMLU-Pro, LiveCodeBench, dan suite APEX-Agents, sambil tetap kompetitif dengan DeepSeek-V4-Flash dan MiMo-V2.5.
- Pada benchmark Korea, model ini mencatatkan rata-rata tertinggi di antara model yang dibandingkan dan kompetitif dengan DeepSeek-V4-Pro pada ukuran kurang dari seperenamnya.
Laporan ini menyoroti kemampuan Solar Open 2 untuk menyimpan seluruh lintasan agen dalam satu konteks sambil mempertahankan kinerja tinggi pada benchmark bahasa Inggris dan Korea.