Kostenlose APILLMAPI-SchlüsselOffiziell
Hugging Face Inference Providers
Ein Key für viele Provider; kleines kostenloses monatliches Guthaben, riesige Modellauswahl
Hugging Face Inference Providers ist ein serverloser Router, der eine einzelne OpenAI-kompatible Anfrage an Drittanbieter-Inferenz-Backends weiterleitet (Cerebras, SambaNova, Together, fal, Replicate und weitere) für tausende Open Models. Jeder Account erhält automatisch ein kleines monatliches Guthaben, das zum Tarif des jeweiligen Anbieters ohne Aufschlag abgerechnet wird.
Free Tier
Kostenlose Accounts erhalten 0,10 $/Monat an Inference-Provider-Guthaben (Stand Juni 2026, kann sich ändern); PRO (9 $/Monat) erhält 2 $/Monat, Team/Enterprise 2 $/Seat. Über das Guthaben hinaus wird der Pass-through-Tarif des Anbieters ohne Aufschlag von Hugging Face berechnet.Ratenlimits
Nicht als festes RPM veröffentlicht; effektiv begrenzt durch Ihr monatliches Guthaben und die eigenen Limits des jeweiligen Upstream-Providers. Das kostenlose Guthaben ist gering, sodass intensiver Einsatz es schnell aufbraucht.Auth
API-SchlüsselBasis-URL
https://router.huggingface.co/v1Was du damit bauen kannst
- Tausende Open Models über einen einzigen Key erreichen, ohne pro Provider zu registrieren
- Ein Nischen- oder neues Open-Weights-Modell für ein Claude-Skill schnell testen
- Denselben Code über mehrere Backends routen, um Kosten und Geschwindigkeit zu vergleichen
- Embeddings und spezialisierte Modelle für einen RAG-Prototypen
Wichtige Endpunkte
- POST
/chat/completionsOpenAI-kompatibler Chat-Completion-Endpunkt, geroutet zu einem gewählten Provider - POST
/embeddingsEmbeddings über einen gerouteten Provider generieren - GET
/modelsModelle auflisten, die über Inference Providers bereitgestellt werden
Mitglieder
Mitglieder erhalten das ausführbare Rezept
Melde dich kostenlos an, um die Beispielanfrage zu kopieren, eine Beispielantwort zu sehen und die Stolperfallen zu lesen.
Tags
llmgatewayopenai-compatibleopen-weightsembeddings