API gratuitaLLMChiave APIUfficiale
Hugging Face Inference Providers
Una sola chiave instrada verso molti provider; piccolo credito mensile gratuito, enorme scelta di modelli
Hugging Face Inference Providers è un router serverless che inoltra una singola richiesta compatibile con OpenAI a backend di inferenza di terze parti (Cerebras, SambaNova, Together, fal, Replicate e altri) per migliaia di modelli open. Ogni account riceve una piccola quota mensile di crediti applicata automaticamente, fatturata al tasso del provider sottostante senza markup.
Piano gratuito
Gli account gratuiti ricevono $0,10/mese in crediti per Inference Provider (verificato giugno 2026, soggetto a modifiche); PRO ($9/mese) riceve $2/mese, Team/Enterprise $2/seat. Oltre il credito si paga la tariffa pass-through del provider senza markup aggiunto da Hugging Face.Limiti di frequenza
Non pubblicati come RPM fissi; limitati in pratica dal saldo mensile di crediti e dai limiti propri del provider upstream. Il credito gratuito è ridotto, quindi un utilizzo intenso lo esaurisce rapidamente.Autenticazione
Chiave APIURL base
https://router.huggingface.co/v1Cosa puoi costruirci
- Accedere a migliaia di modelli open con una sola chiave senza registrazioni per ogni provider
- Testare rapidamente un modello open-weight di nicchia o nuovo per una Claude Skill
- Instradare lo stesso codice su backend diversi per confrontare costi e velocità
- Embeddings e modelli specializzati per un prototipo RAG
Endpoint principali
- POST
/chat/completionsChat completion compatibile con OpenAI instradato verso un provider scelto - POST
/embeddingsGenera embeddings tramite un provider instradato - GET
/modelsElenca i modelli serviti tramite Inference Providers
Membri
I membri ottengono la ricetta eseguibile
Accedi gratuitamente per copiare la richiesta di esempio, vedere una risposta di esempio e leggere le insidie.
Tag
llmgatewayopenai-compatibleopen-weightsembeddings