Kostenlose APILLMAPI-SchlüsselOffiziell
GitHub Models
Frontier- und Open-Models kostenlos mit Ihrem bestehenden GitHub-Token nutzen
GitHub Models gewährt jedem GitHub-Account ratenbegrenzte kostenlose Inferenz gegen einen Modell-Katalog (OpenAI-GPT-Familie, Llama, Mistral, Phi und weitere) über einen OpenAI-kompatiblen Endpunkt. Die Authentifizierung erfolgt per GitHub Personal Access Token mit dem Scope models:read; für die kostenlose Nutzung ist weder ein separates Abrechnungskonto noch eine Kreditkarte erforderlich.
Free Tier
Kostenlos für Experimente, verknüpft mit Ihrem GitHub-Account (keine Kreditkarte). Für produktionstaugliche Limits und größere Kontexte auf kostenpflichtiger Nutzung optieren.Ratenlimits
Kostenlos, pro Account, variiert je Modell-Tier (Stand Juni 2026, Copilot Free): High-Tier-Modelle 10 RPM / 50 Anfragen/Tag; Low-Tier-Modelle 15 RPM / 150 Anfragen/Tag; Embeddings 15 RPM / 150 Anfragen/Tag. Pro-Anfrage-Token-Limits gelten (z. B. 8.000 In / 4.000 Out bei Low-Modellen). Limits können sich ändern.Auth
API-SchlüsselBasis-URL
https://models.github.ai/inferenceWas du damit bauen kannst
- Prototyp mit GPT-Klasse und Open Models über das bereits vorhandene GitHub-Token erstellen
- CI-/Automatisierungsschritte in GitHub Actions, die ein Modell mit dem eingebauten Token aufrufen
- Günstige Embeddings für einen schnellen RAG-Proof-of-Concept
- Ein kostenloser Fallback-Provider für ein Multi-Modell-Claude-Skill
Wichtige Endpunkte
- POST
/chat/completionsOpenAI-kompatibler Chat-Completion-Endpunkt für alle Katalogmodelle - POST
/embeddingsText-Embeddings generieren - GET
/catalog/modelsVerfügbare Modelle im Katalog auflisten
Mitglieder
Mitglieder erhalten das ausführbare Rezept
Melde dich kostenlos an, um die Beispielanfrage zu kopieren, eine Beispielantwort zu sehen und die Stolperfallen zu lesen.
Tags
llminferenceopenai-compatiblegithubembeddings