API gratuiteLLMClé APIOfficiel
Hugging Face Inference Providers
Une seule clé route vers de nombreux fournisseurs ; petit crédit mensuel gratuit, immense choix de modèles
Hugging Face Inference Providers est un routeur serverless qui transmet une requête unique compatible OpenAI à des backends d'inférence tiers (Cerebras, SambaNova, Together, fal, Replicate, et d'autres) pour des milliers de modèles open source. Chaque compte reçoit une petite allocation mensuelle de crédit appliquée automatiquement, facturée au tarif du fournisseur sous-jacent sans majoration.
Palier gratuit
Les comptes gratuits reçoivent 0,10 $/mois en crédits Inference Provider (vérifié juin 2026, susceptible de changer) ; PRO (9 $/mois) reçoit 2 $/mois, Team/Enterprise 2 $/siège. Au-delà du crédit, vous payez le tarif pass-through du fournisseur sans majoration ajoutée par Hugging Face.Limites de débit
Non publié sous forme de RPM fixe ; effectivement limité par votre solde de crédit mensuel et les limites propres du fournisseur en amont. Le crédit gratuit est faible, donc une utilisation intensive l'épuise rapidement.Authentification
Clé APIURL de base
https://router.huggingface.co/v1Ce que vous pourriez construire avec
- Accéder à des milliers de modèles open source via une seule clé sans inscription par fournisseur
- Tester rapidement un modèle open-weight de niche ou récent pour un Claude Skill
- Router le même code sur différents backends pour comparer coût et vitesse
- Embeddings et modèles spécialisés pour un prototype RAG
Endpoints clés
- POST
/chat/completionsComplétion de chat compatible OpenAI routée vers un fournisseur choisi - POST
/embeddingsGénérer des embeddings via un fournisseur routé - GET
/modelsLister les modèles servis via Inference Providers
Membres
Les membres accèdent à la recette exécutable
Inscrivez-vous gratuitement pour copier l'exemple de requête, voir une réponse type et lire les pièges à éviter.
Tags
llmgatewayopenai-compatibleopen-weightsembeddings