Kostenlose APILLMAPI-SchlüsselOffiziell
NVIDIA NIM (build.nvidia.com)
100+ optimierte Modelle kostenlos zum Prototypisieren auf build.nvidia.com
NVIDIAs gehosteter NIM-Katalog auf build.nvidia.com stellt über 100 Modelle (Nemotron, Llama, DeepSeek, Qwen, GLM sowie Vision- und Retrieval-Modelle) hinter einem OpenAI-kompatiblen Endpunkt bereit. Die Anmeldung beim kostenlosen NVIDIA Developer Program liefert einen nvapi-Key ohne Kreditkarte für das Prototypisieren.
Free Tier
Kostenlos für das Prototypisieren über das NVIDIA Developer Program (keine Kreditkarte). Gesteuert durch ein minutenbasiertes Rate-Limit statt einem Token-Preis; produktives Hosting ist separat.Ratenlimits
Kostenloser gehosteter Zugang ~40 Anfragen/Minute (Stand Juni 2026), mit einem Antragspfad zu ~200 RPM. Das alte Signup-Guthaben wurde Anfang 2025 abgeschafft; das 40-RPM-Limit als echte Obergrenze betrachten.Auth
API-SchlüsselBasis-URL
https://integrate.api.nvidia.com/v1Was du damit bauen kannst
- Nemotron und große Open Models (DeepSeek-R1, GLM) ohne GPU-Setup ausprobieren
- Embeddings + Reranking für RAG mit NeMo-Retriever-Modellen
- Vision-Language-Tasks mit NVIDIA-optimierten VLMs
- Ein kostenloses Prototypisierungs-Backend, bevor dieselben NIM-Container selbst gehostet werden
Wichtige Endpunkte
- POST
/chat/completionsOpenAI-kompatibler Chat-Completion-Endpunkt für alle Katalogmodelle - POST
/embeddingsEmbeddings aus NeMo-Retriever-Modellen generieren - GET
/modelsVerfügbare gehostete NIM-Modelle auflisten
Mitglieder
Mitglieder erhalten das ausführbare Rezept
Melde dich kostenlos an, um die Beispielanfrage zu kopieren, eine Beispielantwort zu sehen und die Stolperfallen zu lesen.
Tags
llminferenceopenai-compatiblevisionrag