Tout l'open source
Open SourceVoix et médias2.5k

Coqui STT

Moteur de reconnaissance vocale par deep learning fonctionnant hors ligne sur une large gamme d'appareils.

Coqui STT est un moteur de reconnaissance vocale open-source issu de Mozilla DeepSpeech, conçu pour fonctionner assez rapidement pour une utilisation en temps réel sur des appareils allant des datacenters jusqu'au Raspberry Pi. Il fournit des modèles pré-entraînés dans de nombreuses langues ainsi que des outils pour entraîner et affiner des modèles acoustiques personnalisés pour des vocabulaires spécifiques à un domaine.

Dépôt

coqui-ai/STT

Langage

C++

Ce que vous pourriez construire avec

  • Ajouter une transcription vocale entièrement hors ligne et respectueuse de la vie privée à des applications embarquées ou edge
  • Affiner un modèle STT personnalisé pour un vocabulaire de domaine spécialisé ou un accent particulier
  • Construire une couche de dictée ou de reconnaissance de commandes auto-hébergée sans API cloud

Tags

sttofflinedeepspeechedge