Tutte le API gratuite
API gratuitaLLMChiave APIUfficiale

NVIDIA NIM (build.nvidia.com)

100+ modelli ottimizzati gratuiti per la prototipazione su build.nvidia.com

Il catalogo NIM hosted di NVIDIA su build.nvidia.com espone 100+ modelli (Nemotron, Llama, DeepSeek, Qwen, GLM, più modelli vision e retrieval) dietro un endpoint compatibile con OpenAI. Iscriversi al NVIDIA Developer Program gratuito fornisce una chiave nvapi- senza carta di credito per la prototipazione.

Piano gratuito

Gratuito per la prototipazione tramite il NVIDIA Developer Program (nessuna carta). Governato da un rate limit per minuto piuttosto che da un prezzo per token; l'hosting in produzione è separato.

Limiti di frequenza

L'accesso hosted gratuito è di ~40 richieste/minuto (verificato giugno 2026), con un percorso di candidatura verso ~200 RPM. Il vecchio saldo di crediti al signup è stato eliminato (inizio 2025); considera il rate limit di 40 RPM come il vero tetto.

Autenticazione

Chiave API

URL base

https://integrate.api.nvidia.com/v1

Cosa puoi costruirci

  • Provare Nemotron e grandi modelli open (DeepSeek-R1, GLM) senza configurazione GPU
  • Embeddings + reranking per RAG usando i modelli NeMo Retriever
  • Task vision-language su VLM ottimizzati da NVIDIA
  • Un backend gratuito di prototipazione prima di self-hostare gli stessi container NIM

Endpoint principali

  • POST/chat/completionsChat completion compatibile con OpenAI su tutti i modelli del catalogo
  • POST/embeddingsGenera embeddings dai modelli NeMo Retriever
  • GET/modelsElenca i modelli NIM hosted disponibili
Membri

I membri ottengono la ricetta eseguibile

Accedi gratuitamente per copiare la richiesta di esempio, vedere una risposta di esempio e leggere le insidie.

Tag

llminferenceopenai-compatiblevisionrag