A Baseten agora é um provedor de inferência suportado no Hub da Hugging Face, aprimorando as capacidades de inferência sem servidor diretamente nas páginas dos modelos. Essa integração permite que desenvolvedores acessem o catálogo de modelos de ponta da Baseten por meio dos SDKs e da interface da Hugging Face.

  • O suporte inicial abrange tarefas de conversação e geração de texto para LLMs de pesos abertos, incluindo Kimi K3, DeepSeek V4 Flash e GLM-5.2.
  • Os usuários podem definir chaves de API personalizadas ou usar solicitações roteadas pela Hugging Face cobradas na conta HF.
  • A Baseten está integrada nos SDKs dos clientes (huggingface_hub >= 1.26.1 para Python e @huggingface/inference para JavaScript).
  • O provedor é suportado por frameworks de agentes como Pi, OpenCode, Hermes Agents e OpenClaw.

Essa integração permite que os usuários conectem modelos hospedados pela Baseten em suas aplicações com configuração mínima e acessem LLMs populares de pesos abertos diretamente pelo ecossistema da Hugging Face.