Gratis APILLMAPI-sleutelOfficieel
Groq API
Snelste open-model inferentie ter wereld, gratis zonder creditcard
Groq draait open-weight LLM's (Llama 3.x, gpt-oss, Qwen) op aangepaste LPU-hardware met zeer hoge tokens per seconde. Via de ontwikkelaarsconsole ontvang je een gratis API-key zonder kaart, en de API is OpenAI-compatibel, zodat bestaande SDK-code werkt door simpelweg de basis-URL te wijzigen.
Gratis tier
Gratis Developer-tier, geen creditcard. Dagelijkse en per-minuut limieten per model; upgrade voor hogere limieten plus gebruikskorting.Limieten
Gratis tier (geverifieerd juni 2026): llama-3.1-8b-instant = 30 RPM, 14.400 verzoeken/dag, 6.000 TPM, 500.000 TPD; llama-3.3-70b-versatile = 30 RPM, 1.000 verzoeken/dag, 12.000 TPM, 100.000 TPD. Limieten gelden per organisatie en per model; grotere modellen hebben lagere tokenlimieten.Authenticatie
API-sleutelBasis-URL
https://api.groq.com/openai/v1Wat je ermee zou bouwen
- Lateniegevoelige agent-loops en tool-calling waarbij round-trip-snelheid belangrijk is
- Realtime chat- of spraakautomatiseringen die sub-seconde tokenstreaming nodig hebben
- Whisper-transcriptie voor audio-ingest-pipelines op de gratis tier
- Batchclassificatie met hoge doorvoer binnen het dagelijkse tokenbudget
Belangrijkste endpoints
- POST
/chat/completionsOpenAI-compatibele chatcompletion (streaming ondersteund) - POST
/audio/transcriptionsWhisper-gebaseerde speech-to-text-transcriptie - GET
/modelsBeschikbare modellen en metadata opvragen
Leden
Leden krijgen het kant-en-klare recept
Log gratis in om het voorbeeldverzoek te kopiëren, een voorbeeldantwoord te bekijken en de valkuilen te lezen.
Tags
llminferenceopenai-compatiblelow-latencyopen-weights