Tutte le API gratuite
API gratuitaLLMChiave APIUfficiale

GitHub Models

Modelli frontier e open gratuitamente usando solo il tuo token GitHub

GitHub Models offre a ogni account GitHub un'inferenza gratuita con rate limit su un catalogo di modelli (famiglia GPT di OpenAI, Llama, Mistral, Phi e altri) tramite un endpoint compatibile con OpenAI. L'autenticazione avviene con un personal access token GitHub con lo scope models:read; non è necessario un sistema di fatturazione separato né una carta per l'uso gratuito.

Piano gratuito

Gratuito per sperimentazione, legato al tuo account GitHub (nessuna carta). Passa all'uso a pagamento per limiti di livello produttivo e contesti più ampi.

Limiti di frequenza

Gratuito, per account, varia in base al tier del modello (verificato giugno 2026, Copilot Free): modelli high-tier 10 RPM / 50 req/giorno; modelli low-tier 15 RPM / 150 req/giorno; embeddings 15 RPM / 150 RPD. Si applicano limiti di token per richiesta (es. 8000 in / 4000 out sui modelli low). I limiti sono soggetti a modifica.

Autenticazione

Chiave API

URL base

https://models.github.ai/inference

Cosa puoi costruirci

  • Prototipare con modelli GPT-class e open usando il token GitHub già in proprio possesso
  • Step CI/automazione in GitHub Actions che chiamano un modello con il token integrato
  • Embeddings economici per una rapida proof-of-concept RAG
  • Un provider di fallback gratuito per una Claude Skill multi-modello

Endpoint principali

  • POST/chat/completionsChat completion compatibile con OpenAI su tutti i modelli del catalogo
  • POST/embeddingsGenera embeddings di testo
  • GET/catalog/modelsElenca i modelli disponibili nel catalogo
Membri

I membri ottengono la ricetta eseguibile

Accedi gratuitamente per copiare la richiesta di esempio, vedere una risposta di esempio e leggere le insidie.

Tag

llminferenceopenai-compatiblegithubembeddings