Gratis APILLMAPI-nøkkelOffisiell
Groq API
Raskeste inferens på åpne modeller, gratis uten kredittkort
Groq kjører åpne LLM-er (Llama 3.x, gpt-oss, Qwen) på tilpasset LPU-maskinvare med svært høy tokens-per-sekund. Utviklerkonsollen utsteder en gratis API-nøkkel uten kredittkort, og API-et er OpenAI-kompatibelt, slik at eksisterende SDK-kode fungerer ved å endre base URL.
Gratisnivå
Gratis Developer-nivå, intet kredittkort. Daglige og per-minutt-tak per modell; oppgrader for høyere grenser pluss bruksrabatter.Hastighetsgrenser
Gratisnivå (verifisert juni 2026): llama-3.1-8b-instant = 30 RPM, 14 400 forespørsler/dag, 6 000 TPM, 500 000 TPD; llama-3.3-70b-versatile = 30 RPM, 1 000 forespørsler/dag, 12 000 TPM, 100 000 TPD. Grenser er per organisasjon og per modell; større modeller har lavere tokentak.Autentisering
API-nøkkelBase-URL
https://api.groq.com/openai/v1Hva du kan bygge med det
- Lavlatenssagent-løkker og verktøykall der rundturstid er avgjørende
- Sanntidschat eller stemmeautomatiseringer som krever sub-sekund token-streaming
- Whisper-transkripsjon for lydinnmatingspipelines på gratisnivået
- Høyvolums batch-klassifisering innenfor det daglige tokenbudsjettet
Sentrale endepunkter
- POST
/chat/completionsOpenAI-kompatibel chat-fullføring (streaming støttet) - POST
/audio/transcriptionsWhisper-basert tale-til-tekst-transkripsjon - GET
/modelsList tilgjengelige modeller og metadata
Medlemmer
Medlemmer får den kjørbare oppskriften
Logg inn gratis for å kopiere eksempelforespørselen, se et eksempelsvar og lese fallgruvene.
Tagger
llminferenceopenai-compatiblelow-latencyopen-weights