Huawei telah merilis bobot sumber terbuka untuk openPangu-2.0-Pro, sebuah model bahasa besar (LLM) Mixture of Experts (MoE) yang dilatih pada perangkat keras Ascend. Model ini memiliki 505 miliar parameter total dengan 18 miliar parameter yang diaktifkan dan mendukung panjang konteks sebesar 512k token.

  • Data pra-pelatihan total terdiri dari 34T token.
  • Pasca-pelatihan menggunakan SFT terpadu dengan kemampuan berpikir lambat dan cepat.
  • Pelatihan mencakup beberapa pelatihan RL spesialis dan distilasi on-policy yang menggabungkan beberapa spesialis RL.

Detail teknis model didokumentasikan dalam Laporan Teknis openPangu-2.0.