Alle kostenlosen APIs
Kostenlose APILLMAPI-SchlüsselOffiziell

GitHub Models

Frontier- und Open-Models kostenlos mit Ihrem bestehenden GitHub-Token nutzen

GitHub Models gewährt jedem GitHub-Account ratenbegrenzte kostenlose Inferenz gegen einen Modell-Katalog (OpenAI-GPT-Familie, Llama, Mistral, Phi und weitere) über einen OpenAI-kompatiblen Endpunkt. Die Authentifizierung erfolgt per GitHub Personal Access Token mit dem Scope models:read; für die kostenlose Nutzung ist weder ein separates Abrechnungskonto noch eine Kreditkarte erforderlich.

Free Tier

Kostenlos für Experimente, verknüpft mit Ihrem GitHub-Account (keine Kreditkarte). Für produktionstaugliche Limits und größere Kontexte auf kostenpflichtiger Nutzung optieren.

Ratenlimits

Kostenlos, pro Account, variiert je Modell-Tier (Stand Juni 2026, Copilot Free): High-Tier-Modelle 10 RPM / 50 Anfragen/Tag; Low-Tier-Modelle 15 RPM / 150 Anfragen/Tag; Embeddings 15 RPM / 150 Anfragen/Tag. Pro-Anfrage-Token-Limits gelten (z. B. 8.000 In / 4.000 Out bei Low-Modellen). Limits können sich ändern.

Auth

API-Schlüssel

Basis-URL

https://models.github.ai/inference

Was du damit bauen kannst

  • Prototyp mit GPT-Klasse und Open Models über das bereits vorhandene GitHub-Token erstellen
  • CI-/Automatisierungsschritte in GitHub Actions, die ein Modell mit dem eingebauten Token aufrufen
  • Günstige Embeddings für einen schnellen RAG-Proof-of-Concept
  • Ein kostenloser Fallback-Provider für ein Multi-Modell-Claude-Skill

Wichtige Endpunkte

  • POST/chat/completionsOpenAI-kompatibler Chat-Completion-Endpunkt für alle Katalogmodelle
  • POST/embeddingsText-Embeddings generieren
  • GET/catalog/modelsVerfügbare Modelle im Katalog auflisten
Mitglieder

Mitglieder erhalten das ausführbare Rezept

Melde dich kostenlos an, um die Beispielanfrage zu kopieren, eine Beispielantwort zu sehen und die Stolperfallen zu lesen.

Tags

llminferenceopenai-compatiblegithubembeddings