Gratis APILLMAPI-nyckelOfficiell
NVIDIA NIM (build.nvidia.com)
100+ optimerade modeller gratis för prototypning på build.nvidia.com
NVIDIAs värdbaserade NIM-katalog på build.nvidia.com exponerar 100+ modeller (Nemotron, Llama, DeepSeek, Qwen, GLM, samt vision- och hämtningsmodeller) bakom en OpenAI-kompatibel endpoint. Registrering i det kostnadsfria NVIDIA Developer Program ger dig en nvapi-nyckel utan kreditkort för prototypning.
Gratisnivå
Gratis för prototypning via NVIDIA Developer Program (inget kreditkort). Styrs av en perminuthastighetsgräns snarare än ett per-token-pris; produktionsutrullning är separat.Anropsgränser
Gratis värdbaserad åtkomst är ~40 begäran/minut (verifierat juni 2026), med en ansökningsstig mot ~200 RPM. Den gamla registreringskreditbalansen avvecklades (tidigt 2025); behandla hastighetsgränsen på 40 RPM som det verkliga taket.Autentisering
API-nyckelBas-URL
https://integrate.api.nvidia.com/v1Vad du kan bygga med det
- Prova Nemotron och stora öppna modeller (DeepSeek-R1, GLM) utan GPU-installation
- Embeddings + reranking för RAG med NeMo Retriever-modeller
- Språk-vision-uppgifter mot NVIDIA-optimerade VLM:er
- En gratis prototypnings-backend innan du driftar samma NIM-containrar själv
Centrala endpoints
- POST
/chat/completionsOpenAI-kompatibel chattgenerering för alla modeller i katalogen - POST
/embeddingsGenerera embeddings från NeMo Retriever-modeller - GET
/modelsLista tillgängliga värdbaserade NIM-modeller
Medlemmar
Medlemmar får det körbara receptet
Logga in gratis för att kopiera exempelanropet, se ett exempelsvar och läsa om fallgroparna.
Taggar
llminferenceopenai-compatiblevisionrag