Un nuevo conjunto de datos publicado en Hugging Face proporciona una matriz de precios integral para proveedores de inferencia de modelos, revelando disparidades significativas de costos para los mismos modelos entre diferentes vendedores.
- El análisis cubre 107 modelos de 14 proveedores, totalizando 295 listados extraídos del enrutador HF.
- Qwen3-235B-A22B presenta la mayor diferencia de precios de 4,66x entre las opciones enumeradas.
- openai/gpt-oss-120b está disponible a través de 10 proveedores con una diferencia de precio de 4,41x a pesar de tener los mismos pesos y salidas.
- DeepInfra se identifica como la opción más barata para la mayoría de los modelos, aunque los líderes en latencia varían según el modelo.
El conjunto de datos, actualizado mensualmente, permite a los usuarios comparar costos e identificar al proveedor más económico antes de comprometerse con gastos a largo plazo.