Baseten kini merupakan Penyedia Inferensi yang didukung di Hugging Face Hub, meningkatkan kemampuan inferensi serverless secara langsung pada halaman model. Integrasi ini memungkinkan pengembang mengakses katalog model mutakhir Baseten melalui SDK klien dan antarmuka pengguna Hugging Face.

  • Dukungan awal mencakup tugas percakapan dan generasi teks untuk LLM bobot terbuka termasuk Kimi K3, DeepSeek V4 Flash, dan GLM-5.2.
  • Pengguna dapat mengatur kunci API khusus atau menggunakan permintaan yang dialihkan oleh Hugging Face yang ditagihkan ke akun HF mereka.
  • Baseten terintegrasi ke dalam SDK klien (huggingface_hub >= 1.26.1 untuk Python dan @huggingface/inference untuk JavaScript).
  • Penyedia ini didukung oleh kerangka kerja agen seperti Pi, OpenCode, Hermes Agents, dan OpenClaw.

Integrasi ini memungkinkan pengguna memasang model yang dihosting Baseten ke dalam aplikasi mereka dengan penyiapan minimal dan mengakses LLM bobot terbuka populer secara langsung melalui ekosistem Hugging Face.