API gratuitaLLMClave APIOficial
Hugging Face Inference Providers
Una clave enruta a múltiples proveedores; pequeño crédito mensual gratuito, enorme selección de modelos
Hugging Face Inference Providers es un router serverless que reenvía una única solicitud compatible con OpenAI a backends de inferencia de terceros (Cerebras, SambaNova, Together, fal, Replicate y otros) para miles de modelos abiertos. Cada cuenta recibe una pequeña asignación mensual de crédito aplicada automáticamente, facturada a la tarifa del proveedor subyacente sin comisiones adicionales.
Nivel gratuito
Las cuentas gratuitas obtienen 0,10 $/mes en créditos de Inference Provider (verificado junio 2026, sujeto a cambios); PRO (9 $/mes) obtiene 2 $/mes, Team/Enterprise 2 $/puesto. Más allá del crédito pagas la tarifa pass-through del proveedor sin comisión adicional de Hugging Face.Límites de uso
No publicados como RPM fijo; efectivamente limitados por tu saldo de crédito mensual y los límites propios del proveedor upstream. El crédito gratuito es pequeño, por lo que el uso intensivo lo agota rápidamente.Autenticación
Clave APIURL base
https://router.huggingface.co/v1Qué podrías construir con ella
- Acceder a miles de modelos abiertos con una sola clave sin registros por proveedor
- Probar rápidamente un modelo de pesos abiertos especializado o nuevo para una Claude Skill
- Enrutar el mismo código entre backends para comparar coste y velocidad
- Embeddings y modelos especializados para un prototipo RAG
Endpoints clave
- POST
/chat/completionsCompletado de chat compatible con OpenAI enrutado a un proveedor elegido - POST
/embeddingsGenerar embeddings a través de un proveedor enrutado - GET
/modelsListar modelos servidos a través de Inference Providers
Miembros
Los miembros obtienen la receta lista para ejecutar
Inicia sesión gratis para copiar la solicitud de ejemplo, ver una respuesta de muestra y leer las trampas.
Etiquetas
llmgatewayopenai-compatibleopen-weightsembeddings