Alle gratis API's
Gratis APILLMAPI-sleutelOfficieel

Groq API

Snelste open-model inferentie ter wereld, gratis zonder creditcard

Groq draait open-weight LLM's (Llama 3.x, gpt-oss, Qwen) op aangepaste LPU-hardware met zeer hoge tokens per seconde. Via de ontwikkelaarsconsole ontvang je een gratis API-key zonder kaart, en de API is OpenAI-compatibel, zodat bestaande SDK-code werkt door simpelweg de basis-URL te wijzigen.

Gratis tier

Gratis Developer-tier, geen creditcard. Dagelijkse en per-minuut limieten per model; upgrade voor hogere limieten plus gebruikskorting.

Limieten

Gratis tier (geverifieerd juni 2026): llama-3.1-8b-instant = 30 RPM, 14.400 verzoeken/dag, 6.000 TPM, 500.000 TPD; llama-3.3-70b-versatile = 30 RPM, 1.000 verzoeken/dag, 12.000 TPM, 100.000 TPD. Limieten gelden per organisatie en per model; grotere modellen hebben lagere tokenlimieten.

Authenticatie

API-sleutel

Basis-URL

https://api.groq.com/openai/v1

Wat je ermee zou bouwen

  • Lateniegevoelige agent-loops en tool-calling waarbij round-trip-snelheid belangrijk is
  • Realtime chat- of spraakautomatiseringen die sub-seconde tokenstreaming nodig hebben
  • Whisper-transcriptie voor audio-ingest-pipelines op de gratis tier
  • Batchclassificatie met hoge doorvoer binnen het dagelijkse tokenbudget

Belangrijkste endpoints

  • POST/chat/completionsOpenAI-compatibele chatcompletion (streaming ondersteund)
  • POST/audio/transcriptionsWhisper-gebaseerde speech-to-text-transcriptie
  • GET/modelsBeschikbare modellen en metadata opvragen
Leden

Leden krijgen het kant-en-klare recept

Log gratis in om het voorbeeldverzoek te kopiëren, een voorbeeldantwoord te bekijken en de valkuilen te lezen.

Tags

llminferenceopenai-compatiblelow-latencyopen-weights