Gratis APILLMAPI-sleutelOfficieel
GitHub Models
Frontier- en open modellen gratis met alleen je GitHub-token
GitHub Models geeft elk GitHub-account rate-gelimiteerde gratis inferentie op een catalogus van modellen (OpenAI GPT-familie, Llama, Mistral, Phi en meer) via een OpenAI-compatibel endpoint. Authenticatie werkt met een GitHub Personal Access Token met de models:read-scope; er is geen aparte facturering of kaart nodig voor gratis gebruik.
Gratis tier
Gratis voor experimenten, gekoppeld aan je GitHub-account (geen kaart). Opt-in voor betaald gebruik voor productielimieten en grotere context.Limieten
Gratis, per account, varieert per modelcategorie (geverifieerd juni 2026, Copilot Free): high-tier modellen 10 RPM / 50 verzoeken/dag; low-tier modellen 15 RPM / 150 verzoeken/dag; embeddings 15 RPM / 150 RPD. Per-verzoek tokenlimieten gelden (bijv. 8.000 in / 4.000 uit op low-modellen). Limieten kunnen wijzigen.Authenticatie
API-sleutelBasis-URL
https://models.github.ai/inferenceWat je ermee zou bouwen
- Prototype met GPT-klasse en open modellen via het GitHub-token dat je al hebt
- CI/automatiseringsstappen in GitHub Actions die een model aanroepen met het ingebouwde token
- Goedkope embeddings voor een snelle RAG-proof-of-concept
- Een gratis fallback-provider voor een multi-model Claude Skill
Belangrijkste endpoints
- POST
/chat/completionsOpenAI-compatibele chatcompletion over catalogusmodellen - POST
/embeddingsTekstembeddings genereren - GET
/catalog/modelsDe beschikbare modellen in de catalogus opvragen
Leden
Leden krijgen het kant-en-klare recept
Log gratis in om het voorbeeldverzoek te kopiëren, een voorbeeldantwoord te bekijken en de valkuilen te lezen.
Tags
llminferenceopenai-compatiblegithubembeddings