Alle kostenlosen APIs
Kostenlose APILLMAPI-SchlüsselOffiziell

NVIDIA NIM (build.nvidia.com)

100+ optimierte Modelle kostenlos zum Prototypisieren auf build.nvidia.com

NVIDIAs gehosteter NIM-Katalog auf build.nvidia.com stellt über 100 Modelle (Nemotron, Llama, DeepSeek, Qwen, GLM sowie Vision- und Retrieval-Modelle) hinter einem OpenAI-kompatiblen Endpunkt bereit. Die Anmeldung beim kostenlosen NVIDIA Developer Program liefert einen nvapi-Key ohne Kreditkarte für das Prototypisieren.

Free Tier

Kostenlos für das Prototypisieren über das NVIDIA Developer Program (keine Kreditkarte). Gesteuert durch ein minutenbasiertes Rate-Limit statt einem Token-Preis; produktives Hosting ist separat.

Ratenlimits

Kostenloser gehosteter Zugang ~40 Anfragen/Minute (Stand Juni 2026), mit einem Antragspfad zu ~200 RPM. Das alte Signup-Guthaben wurde Anfang 2025 abgeschafft; das 40-RPM-Limit als echte Obergrenze betrachten.

Auth

API-Schlüssel

Basis-URL

https://integrate.api.nvidia.com/v1

Was du damit bauen kannst

  • Nemotron und große Open Models (DeepSeek-R1, GLM) ohne GPU-Setup ausprobieren
  • Embeddings + Reranking für RAG mit NeMo-Retriever-Modellen
  • Vision-Language-Tasks mit NVIDIA-optimierten VLMs
  • Ein kostenloses Prototypisierungs-Backend, bevor dieselben NIM-Container selbst gehostet werden

Wichtige Endpunkte

  • POST/chat/completionsOpenAI-kompatibler Chat-Completion-Endpunkt für alle Katalogmodelle
  • POST/embeddingsEmbeddings aus NeMo-Retriever-Modellen generieren
  • GET/modelsVerfügbare gehostete NIM-Modelle auflisten
Mitglieder

Mitglieder erhalten das ausführbare Rezept

Melde dich kostenlos an, um die Beispielanfrage zu kopieren, eine Beispielantwort zu sehen und die Stolperfallen zu lesen.

Tags

llminferenceopenai-compatiblevisionrag