API gratuiteVision et paroleClé APIOfficiel
Gladia
10 heures de transcription gratuites récurrentes chaque mois, sans carte, toutes les fonctionnalités activées
Gladia fournit une infrastructure audio pour le speech-to-text construite sur une stack dérivée de Whisper, avec du batch asynchrone et du streaming en temps réel, diarisation des locuteurs, traduction et horodatages au niveau des mots. Elle cible les audios multilingues et à code-switching. Le niveau gratuit se renouvelle chaque mois avec le jeu de fonctionnalités complet activé.
Palier gratuit
Niveau gratuit : 10 heures/mois, sans carte ; puis Starter ~0,61 $/hr async, ~0,75 $/hr temps réel (remises sur volume à partir de Growth)Limites de débit
Concurrence du niveau gratuit non publiée ; usage plafonné par l'allocation mensuelle de 10hAuthentification
Clé APIURL de base
https://api.gladia.ioCe que vous pourriez construire avec
- Transcrire des audios multilingues ou à code-switching et évaluer le WER sur le niveau gratuit
- Ajouter des transcriptions diarisées et horodatées à un pipeline média
- Sous-titrage en streaming temps réel pour une automatisation vocale
Endpoints clés
- POST
/v2/uploadUploader un fichier audio et obtenir une URL hébergée - POST
/v2/pre-recordedDémarrer la transcription asynchrone d'une URL audio, renvoie un result id et une result_url - GET
/v2/pre-recorded/{id}Interroger un job de transcription pour le résultat final
Membres
Les membres accèdent à la recette exécutable
Inscrivez-vous gratuitement pour copier l'exemple de requête, voir une réponse type et lire les pièges à éviter.
Tags
speech-to-textaudiotranscriptiondiarizationmultilingual