Toutes les API gratuites
API gratuiteLLMClé APIOfficiel

Hugging Face Inference Providers

Une seule clé route vers de nombreux fournisseurs ; petit crédit mensuel gratuit, immense choix de modèles

Hugging Face Inference Providers est un routeur serverless qui transmet une requête unique compatible OpenAI à des backends d'inférence tiers (Cerebras, SambaNova, Together, fal, Replicate, et d'autres) pour des milliers de modèles open source. Chaque compte reçoit une petite allocation mensuelle de crédit appliquée automatiquement, facturée au tarif du fournisseur sous-jacent sans majoration.

Palier gratuit

Les comptes gratuits reçoivent 0,10 $/mois en crédits Inference Provider (vérifié juin 2026, susceptible de changer) ; PRO (9 $/mois) reçoit 2 $/mois, Team/Enterprise 2 $/siège. Au-delà du crédit, vous payez le tarif pass-through du fournisseur sans majoration ajoutée par Hugging Face.

Limites de débit

Non publié sous forme de RPM fixe ; effectivement limité par votre solde de crédit mensuel et les limites propres du fournisseur en amont. Le crédit gratuit est faible, donc une utilisation intensive l'épuise rapidement.

Authentification

Clé API

URL de base

https://router.huggingface.co/v1

Ce que vous pourriez construire avec

  • Accéder à des milliers de modèles open source via une seule clé sans inscription par fournisseur
  • Tester rapidement un modèle open-weight de niche ou récent pour un Claude Skill
  • Router le même code sur différents backends pour comparer coût et vitesse
  • Embeddings et modèles spécialisés pour un prototype RAG

Endpoints clés

  • POST/chat/completionsComplétion de chat compatible OpenAI routée vers un fournisseur choisi
  • POST/embeddingsGénérer des embeddings via un fournisseur routé
  • GET/modelsLister les modèles servis via Inference Providers
Membres

Les membres accèdent à la recette exécutable

Inscrivez-vous gratuitement pour copier l'exemple de requête, voir une réponse type et lire les pièges à éviter.

Tags

llmgatewayopenai-compatibleopen-weightsembeddings