Um novo conjunto de dados publicado no Hugging Face fornece uma matriz de preços abrangente para provedores de inferência de modelos, revelando disparidades significativas de custo para os mesmos modelos entre diferentes fornecedores.

  • A análise abrange 107 modelos de 14 provedores, totalizando 295 listagens retiradas do roteador HF.
  • Qwen3-235B-A22B apresenta o maior spread de preços de 4,66x entre as opções listadas.
  • openai/gpt-oss-120b está disponível através de 10 provedores com uma diferença de preço de 4,41x apesar de ter os mesmos pesos e saídas.
  • DeepInfra é identificado como a opção mais barata para a maioria dos modelos, embora os líderes em latência variem conforme o modelo.

O conjunto de dados, atualizado mensalmente, permite que os usuários comparem custos e identifiquem o provedor mais econômico antes de se comprometer com gastos de longo prazo.