API gratuiteLLMClé APIOfficiel
NVIDIA NIM (build.nvidia.com)
Plus de 100 modèles optimisés gratuits pour le prototypage sur build.nvidia.com
Le catalogue NIM hébergé par NVIDIA sur build.nvidia.com expose plus de 100 modèles (Nemotron, Llama, DeepSeek, Qwen, GLM, ainsi que des modèles vision et récupération) derrière un endpoint compatible OpenAI. L'inscription au programme gratuit NVIDIA Developer Program vous donne une clé nvapi- sans carte bancaire pour le prototypage.
Palier gratuit
Gratuit pour le prototypage via le NVIDIA Developer Program (sans carte). Gouverné par une limite de débit par minute plutôt qu'un prix par token ; l'hébergement en production est séparé.Limites de débit
L'accès hébergé gratuit est de ~40 requêtes/minute (vérifié juin 2026), avec un processus de demande vers ~200 RPM. L'ancien solde de crédit à l'inscription a été supprimé (début 2025) ; considérez la limite de 40 RPM comme le vrai plafond.Authentification
Clé APIURL de base
https://integrate.api.nvidia.com/v1Ce que vous pourriez construire avec
- Tester Nemotron et les grands modèles open source (DeepSeek-R1, GLM) sans configuration GPU
- Embeddings + reranking pour RAG avec les modèles NeMo Retriever
- Tâches de vision-langage sur des VLMs optimisés par NVIDIA
- Un backend de prototypage gratuit avant d'auto-héberger les mêmes conteneurs NIM
Endpoints clés
- POST
/chat/completionsComplétion de chat compatible OpenAI sur les modèles du catalogue - POST
/embeddingsGénérer des embeddings depuis les modèles NeMo Retriever - GET
/modelsLister les modèles NIM hébergés disponibles
Membres
Les membres accèdent à la recette exécutable
Inscrivez-vous gratuitement pour copier l'exemple de requête, voir une réponse type et lire les pièges à éviter.
Tags
llminferenceopenai-compatiblevisionrag