Alle gratis API-er
Gratis APILLMAPI-nøkkelOffisiell

Groq API

Raskeste inferens på åpne modeller, gratis uten kredittkort

Groq kjører åpne LLM-er (Llama 3.x, gpt-oss, Qwen) på tilpasset LPU-maskinvare med svært høy tokens-per-sekund. Utviklerkonsollen utsteder en gratis API-nøkkel uten kredittkort, og API-et er OpenAI-kompatibelt, slik at eksisterende SDK-kode fungerer ved å endre base URL.

Gratisnivå

Gratis Developer-nivå, intet kredittkort. Daglige og per-minutt-tak per modell; oppgrader for høyere grenser pluss bruksrabatter.

Hastighetsgrenser

Gratisnivå (verifisert juni 2026): llama-3.1-8b-instant = 30 RPM, 14 400 forespørsler/dag, 6 000 TPM, 500 000 TPD; llama-3.3-70b-versatile = 30 RPM, 1 000 forespørsler/dag, 12 000 TPM, 100 000 TPD. Grenser er per organisasjon og per modell; større modeller har lavere tokentak.

Autentisering

API-nøkkel

Base-URL

https://api.groq.com/openai/v1

Hva du kan bygge med det

  • Lavlatenssagent-løkker og verktøykall der rundturstid er avgjørende
  • Sanntidschat eller stemmeautomatiseringer som krever sub-sekund token-streaming
  • Whisper-transkripsjon for lydinnmatingspipelines på gratisnivået
  • Høyvolums batch-klassifisering innenfor det daglige tokenbudsjettet

Sentrale endepunkter

  • POST/chat/completionsOpenAI-kompatibel chat-fullføring (streaming støttet)
  • POST/audio/transcriptionsWhisper-basert tale-til-tekst-transkripsjon
  • GET/modelsList tilgjengelige modeller og metadata
Medlemmer

Medlemmer får den kjørbare oppskriften

Logg inn gratis for å kopiere eksempelforespørselen, se et eksempelsvar og lese fallgruvene.

Tagger

llminferenceopenai-compatiblelow-latencyopen-weights