Tutte le API gratuite
API gratuitaLLMChiave APIUfficiale

Hugging Face Inference Providers

Una sola chiave instrada verso molti provider; piccolo credito mensile gratuito, enorme scelta di modelli

Hugging Face Inference Providers è un router serverless che inoltra una singola richiesta compatibile con OpenAI a backend di inferenza di terze parti (Cerebras, SambaNova, Together, fal, Replicate e altri) per migliaia di modelli open. Ogni account riceve una piccola quota mensile di crediti applicata automaticamente, fatturata al tasso del provider sottostante senza markup.

Piano gratuito

Gli account gratuiti ricevono $0,10/mese in crediti per Inference Provider (verificato giugno 2026, soggetto a modifiche); PRO ($9/mese) riceve $2/mese, Team/Enterprise $2/seat. Oltre il credito si paga la tariffa pass-through del provider senza markup aggiunto da Hugging Face.

Limiti di frequenza

Non pubblicati come RPM fissi; limitati in pratica dal saldo mensile di crediti e dai limiti propri del provider upstream. Il credito gratuito è ridotto, quindi un utilizzo intenso lo esaurisce rapidamente.

Autenticazione

Chiave API

URL base

https://router.huggingface.co/v1

Cosa puoi costruirci

  • Accedere a migliaia di modelli open con una sola chiave senza registrazioni per ogni provider
  • Testare rapidamente un modello open-weight di nicchia o nuovo per una Claude Skill
  • Instradare lo stesso codice su backend diversi per confrontare costi e velocità
  • Embeddings e modelli specializzati per un prototipo RAG

Endpoint principali

  • POST/chat/completionsChat completion compatibile con OpenAI instradato verso un provider scelto
  • POST/embeddingsGenera embeddings tramite un provider instradato
  • GET/modelsElenca i modelli serviti tramite Inference Providers
Membri

I membri ottengono la ricetta eseguibile

Accedi gratuitamente per copiare la richiesta di esempio, vedere una risposta di esempio e leggere le insidie.

Tag

llmgatewayopenai-compatibleopen-weightsembeddings