Gratis APILLMAPI-sleutelOfficieel
NVIDIA NIM (build.nvidia.com)
100+ geoptimaliseerde modellen gratis voor prototyping op build.nvidia.com
De gehoste NIM-catalogus van NVIDIA op build.nvidia.com biedt 100+ modellen (Nemotron, Llama, DeepSeek, Qwen, GLM, plus vision- en retrieval-modellen) achter een OpenAI-compatibel endpoint. Aanmelden voor het gratis NVIDIA Developer Program geeft je een nvapi-key zonder creditcard voor prototyping.
Gratis tier
Gratis voor prototyping via het NVIDIA Developer Program (geen kaart). Begrensd door een per-minuut rate-limiet in plaats van een prijs per token; productiehosting is separaat.Limieten
Gratis gehoste toegang is ~40 verzoeken/minuut (geverifieerd juni 2026), met een aanvraagtraject naar ~200 RPM. Het oude aanmeldkrediet is uitgefaseerd (begin 2025); beschouw de 40 RPM rate-limiet als het echte plafond.Authenticatie
API-sleutelBasis-URL
https://integrate.api.nvidia.com/v1Wat je ermee zou bouwen
- Nemotron en grote open modellen (DeepSeek-R1, GLM) uitproberen zonder GPU-setup
- Embeddings + reranking voor RAG met NeMo Retriever-modellen
- Vision-language taken met NVIDIA-geoptimaliseerde VLM's
- Een gratis prototyping-backend voordat je dezelfde NIM-containers zelf host
Belangrijkste endpoints
- POST
/chat/completionsOpenAI-compatibele chatcompletion over catalogusmodellen - POST
/embeddingsEmbeddings genereren van NeMo Retriever-modellen - GET
/modelsBeschikbare gehoste NIM-modellen opvragen
Leden
Leden krijgen het kant-en-klare recept
Log gratis in om het voorbeeldverzoek te kopiëren, een voorbeeldantwoord te bekijken en de valkuilen te lezen.
Tags
llminferenceopenai-compatiblevisionrag