Baseten est désormais un fournisseur d'inférence pris en charge sur le Hub Hugging Face, améliorant les capacités d'inférence sans serveur directement sur les pages des modèles. Cette intégration permet aux développeurs d'accéder au catalogue de modèles de pointe de Baseten via les SDK clients et l'interface utilisateur de Hugging Face.

  • Le support initial couvre les tâches conversationnelles et de génération de texte pour les LLM à poids ouverts, notamment Kimi K3, DeepSeek V4 Flash et GLM-5.2.
  • Les utilisateurs peuvent définir des clés API personnalisées ou utiliser les requêtes routées par Hugging Face facturées sur leur compte HF.
  • Baseten est intégré dans les SDK clients (huggingface_hub >= 1.26.1 pour Python et @huggingface/inference pour JavaScript).
  • Le fournisseur est pris en charge par des frameworks d'agents tels que Pi, OpenCode, Hermes Agents et OpenClaw.

Cette intégration permet aux utilisateurs de connecter des modèles hébergés par Baseten à leurs applications avec une configuration minimale et d'accéder directement aux LLM à poids ouverts populaires via l'écosystème Hugging Face.