Alle gratis API's
Gratis APILLMAPI-sleutelOfficieel

NVIDIA NIM (build.nvidia.com)

100+ geoptimaliseerde modellen gratis voor prototyping op build.nvidia.com

De gehoste NIM-catalogus van NVIDIA op build.nvidia.com biedt 100+ modellen (Nemotron, Llama, DeepSeek, Qwen, GLM, plus vision- en retrieval-modellen) achter een OpenAI-compatibel endpoint. Aanmelden voor het gratis NVIDIA Developer Program geeft je een nvapi-key zonder creditcard voor prototyping.

Gratis tier

Gratis voor prototyping via het NVIDIA Developer Program (geen kaart). Begrensd door een per-minuut rate-limiet in plaats van een prijs per token; productiehosting is separaat.

Limieten

Gratis gehoste toegang is ~40 verzoeken/minuut (geverifieerd juni 2026), met een aanvraagtraject naar ~200 RPM. Het oude aanmeldkrediet is uitgefaseerd (begin 2025); beschouw de 40 RPM rate-limiet als het echte plafond.

Authenticatie

API-sleutel

Basis-URL

https://integrate.api.nvidia.com/v1

Wat je ermee zou bouwen

  • Nemotron en grote open modellen (DeepSeek-R1, GLM) uitproberen zonder GPU-setup
  • Embeddings + reranking voor RAG met NeMo Retriever-modellen
  • Vision-language taken met NVIDIA-geoptimaliseerde VLM's
  • Een gratis prototyping-backend voordat je dezelfde NIM-containers zelf host

Belangrijkste endpoints

  • POST/chat/completionsOpenAI-compatibele chatcompletion over catalogusmodellen
  • POST/embeddingsEmbeddings genereren van NeMo Retriever-modellen
  • GET/modelsBeschikbare gehoste NIM-modellen opvragen
Leden

Leden krijgen het kant-en-klare recept

Log gratis in om het voorbeeldverzoek te kopiëren, een voorbeeldantwoord te bekijken en de valkuilen te lezen.

Tags

llminferenceopenai-compatiblevisionrag