API gratuiteLLMClé APIOfficiel
Google Gemini API
Gemini Flash multimodal gratuit avec un quota journalier de requêtes, sans carte
L'API Gemini de Google propose un niveau gratuit via Google AI Studio couvrant les familles de modèles Gemini Flash et Flash-Lite, y compris le texte, la vision et les usages à long contexte. Vous générez une clé dans AI Studio sans carte bancaire et appelez un endpoint REST ou utilisez les SDK officiels.
Palier gratuit
Niveau gratuit sur les modèles Flash / Flash-Lite (sans carte). Les modèles Pro sont passés derrière un projet payant (facturation activée) en 2026. Les limites du niveau gratuit ne sont pas garanties ; Google les a réduites de 50 à 80 % le 7 décembre 2025 et les révise sans préavis.Limites de débit
Par projet, par modèle (vérifié juin 2026) : Gemini 2.5/3 Flash = 10 RPM, 250 requêtes/jour ; Flash-Lite = 15 RPM, 1 000 requêtes/jour ; 250K TPM partagés. Pro (5 RPM, 100 RPD) nécessite désormais la facturation. Les quotas journaliers se réinitialisent à minuit Pacifique. Consultez AI Studio pour les limites actuelles de votre projet.Authentification
Clé APIURL de base
https://generativelanguage.googleapis.com/v1betaCe que vous pourriez construire avec
- Automatisations multimodales lisant des images, PDF ou audio en parallèle du texte
- Résumé de documents à long contexte sur la grande fenêtre de tokens de Flash
- Embeddings gratuits pour des prototypes RAG légers
- Solutions de repli multimodales pour des Claude Skills nécessitant la couverture multimodale de Google
Endpoints clés
- POST
/models/{model}:generateContentGénérer du contenu texte/multimodal à partir d'un prompt - POST
/models/{model}:streamGenerateContentStreamer une génération multimodale - POST
/models/{model}:embedContentProduire des embeddings de texte - GET
/modelsLister les modèles disponibles et les méthodes prises en charge
Membres
Les membres accèdent à la recette exécutable
Inscrivez-vous gratuitement pour copier l'exemple de requête, voir une réponse type et lire les pièges à éviter.
Tags
llmmultimodalvisionembeddingslong-context