Gratis APILLMAPI-nyckelOfficiell
Groq API
Snabbaste inferensen för öppna modeller, gratis utan kreditkort
Groq kör open-weight-LLM:er (Llama 3.x, gpt-oss, Qwen) på anpassad LPU-hårdvara med mycket hög tokens per sekund. Utvecklarkonsolen utfärdar en gratis API-nyckel utan kreditkort och API:et är OpenAI-kompatibelt så befintlig SDK-kod fungerar genom att ändra bas-URL:en.
Gratisnivå
Gratis Developer-nivå, inget kreditkort. Dagliga och perminutsgränser per modell; uppgradera för högre gränser och användningsrabatter.Anropsgränser
Gratisnivå (verifierad juni 2026): llama-3.1-8b-instant = 30 RPM, 14 400 begäran/dag, 6 000 TPM, 500 000 TPD; llama-3.3-70b-versatile = 30 RPM, 1 000 begäran/dag, 12 000 TPM, 100 000 TPD. Gränser är per organisation och per modell; större modeller har lägre tokentak.Autentisering
API-nyckelBas-URL
https://api.groq.com/openai/v1Vad du kan bygga med det
- Agentloopar med låg latens och verktygsanrop där round-trip-hastigheten spelar roll
- Realtidschatt eller röstautomatiseringar som behöver tokenströmning under en sekund
- Whisper-transkription för ljudinmatningspipelines på gratisnivån
- Batchklassificering med högt genomflöde inom den dagliga tokenbudgeten
Centrala endpoints
- POST
/chat/completionsOpenAI-kompatibel chattgenerering (streaming stöds) - POST
/audio/transcriptionsWhisper-baserad tal-till-text-transkription - GET
/modelsLista tillgängliga modeller och metadata
Medlemmar
Medlemmar får det körbara receptet
Logga in gratis för att kopiera exempelanropet, se ett exempelsvar och läsa om fallgroparna.
Taggar
llminferenceopenai-compatiblelow-latencyopen-weights