API gratuitaLLMClave APIOficial
GitHub Models
Modelos frontier y abiertos de forma gratuita usando solo tu token de GitHub
GitHub Models ofrece inferencia gratuita con límite de tasa para todas las cuentas de GitHub sobre un catálogo de modelos (familia GPT de OpenAI, Llama, Mistral, Phi y más) a través de un endpoint compatible con OpenAI. La autenticación se realiza con un token de acceso personal de GitHub con el alcance models:read; no se necesita facturación ni tarjeta para el uso gratuito.
Nivel gratuito
Gratuito para experimentación, vinculado a tu cuenta de GitHub (sin tarjeta). Activa el uso de pago para límites de nivel producción y contextos más amplios.Límites de uso
Gratuito, por cuenta, varía según el nivel del modelo (verificado junio 2026, Copilot Free): modelos de nivel alto 10 RPM / 50 solicitudes/día; modelos de nivel bajo 15 RPM / 150 solicitudes/día; embeddings 15 RPM / 150 RPD. Se aplican límites de tokens por solicitud (p. ej. 8000 entrada / 4000 salida en modelos bajos). Los límites están sujetos a cambios.Autenticación
Clave APIURL base
https://models.github.ai/inferenceQué podrías construir con ella
- Prototipar con modelos de clase GPT y modelos abiertos usando el token de GitHub que ya tienes
- Pasos de CI/automatización en GitHub Actions que llaman a un modelo con el token integrado
- Embeddings económicos para una prueba de concepto RAG rápida
- Un proveedor de fallback gratuito para una Claude Skill multi-modelo
Endpoints clave
- POST
/chat/completionsCompletado de chat compatible con OpenAI en todos los modelos del catálogo - POST
/embeddingsGenerar embeddings de texto - GET
/catalog/modelsListar los modelos disponibles en el catálogo
Miembros
Los miembros obtienen la receta lista para ejecutar
Inicia sesión gratis para copiar la solicitud de ejemplo, ver una respuesta de muestra y leer las trampas.
Etiquetas
llminferenceopenai-compatiblegithubembeddings