API gratuitaLLMChiave APIUfficiale
GitHub Models
Modelli frontier e open gratuitamente usando solo il tuo token GitHub
GitHub Models offre a ogni account GitHub un'inferenza gratuita con rate limit su un catalogo di modelli (famiglia GPT di OpenAI, Llama, Mistral, Phi e altri) tramite un endpoint compatibile con OpenAI. L'autenticazione avviene con un personal access token GitHub con lo scope models:read; non è necessario un sistema di fatturazione separato né una carta per l'uso gratuito.
Piano gratuito
Gratuito per sperimentazione, legato al tuo account GitHub (nessuna carta). Passa all'uso a pagamento per limiti di livello produttivo e contesti più ampi.Limiti di frequenza
Gratuito, per account, varia in base al tier del modello (verificato giugno 2026, Copilot Free): modelli high-tier 10 RPM / 50 req/giorno; modelli low-tier 15 RPM / 150 req/giorno; embeddings 15 RPM / 150 RPD. Si applicano limiti di token per richiesta (es. 8000 in / 4000 out sui modelli low). I limiti sono soggetti a modifica.Autenticazione
Chiave APIURL base
https://models.github.ai/inferenceCosa puoi costruirci
- Prototipare con modelli GPT-class e open usando il token GitHub già in proprio possesso
- Step CI/automazione in GitHub Actions che chiamano un modello con il token integrato
- Embeddings economici per una rapida proof-of-concept RAG
- Un provider di fallback gratuito per una Claude Skill multi-modello
Endpoint principali
- POST
/chat/completionsChat completion compatibile con OpenAI su tutti i modelli del catalogo - POST
/embeddingsGenera embeddings di testo - GET
/catalog/modelsElenca i modelli disponibili nel catalogo
Membri
I membri ottengono la ricetta eseguibile
Accedi gratuitamente per copiare la richiesta di esempio, vedere una risposta di esempio e leggere le insidie.
Tag
llminferenceopenai-compatiblegithubembeddings