Todas las APIs gratuitas
API gratuitaLLMClave APIOficial

Hugging Face Inference Providers

Una clave enruta a múltiples proveedores; pequeño crédito mensual gratuito, enorme selección de modelos

Hugging Face Inference Providers es un router serverless que reenvía una única solicitud compatible con OpenAI a backends de inferencia de terceros (Cerebras, SambaNova, Together, fal, Replicate y otros) para miles de modelos abiertos. Cada cuenta recibe una pequeña asignación mensual de crédito aplicada automáticamente, facturada a la tarifa del proveedor subyacente sin comisiones adicionales.

Nivel gratuito

Las cuentas gratuitas obtienen 0,10 $/mes en créditos de Inference Provider (verificado junio 2026, sujeto a cambios); PRO (9 $/mes) obtiene 2 $/mes, Team/Enterprise 2 $/puesto. Más allá del crédito pagas la tarifa pass-through del proveedor sin comisión adicional de Hugging Face.

Límites de uso

No publicados como RPM fijo; efectivamente limitados por tu saldo de crédito mensual y los límites propios del proveedor upstream. El crédito gratuito es pequeño, por lo que el uso intensivo lo agota rápidamente.

Autenticación

Clave API

URL base

https://router.huggingface.co/v1

Qué podrías construir con ella

  • Acceder a miles de modelos abiertos con una sola clave sin registros por proveedor
  • Probar rápidamente un modelo de pesos abiertos especializado o nuevo para una Claude Skill
  • Enrutar el mismo código entre backends para comparar coste y velocidad
  • Embeddings y modelos especializados para un prototipo RAG

Endpoints clave

  • POST/chat/completionsCompletado de chat compatible con OpenAI enrutado a un proveedor elegido
  • POST/embeddingsGenerar embeddings a través de un proveedor enrutado
  • GET/modelsListar modelos servidos a través de Inference Providers
Miembros

Los miembros obtienen la receta lista para ejecutar

Inicia sesión gratis para copiar la solicitud de ejemplo, ver una respuesta de muestra y leer las trampas.

Etiquetas

llmgatewayopenai-compatibleopen-weightsembeddings