Código abiertoVoz y medios2.5k
Coqui STT
Motor de reconocimiento de voz por deep learning que funciona sin conexión en una amplia gama de dispositivos.
Coqui STT es un motor de reconocimiento de voz de código abierto descendiente de Mozilla DeepSpeech, diseñado para funcionar con suficiente rapidez para uso en tiempo real en dispositivos que van desde centros de datos hasta una Raspberry Pi. Incluye modelos preentrenados en varios idiomas, además de herramientas para entrenar y ajustar modelos acústicos personalizados para vocabularios de dominios específicos.
Repositorio
coqui-ai/STTLenguaje
C++Lo que construirías con esto
- Añadir transcripción de voz totalmente sin conexión y respetuosa con la privacidad a aplicaciones embebidas o de edge
- Ajustar un modelo STT personalizado para un vocabulario de dominio especializado o acento concreto
- Construir una capa de dictado o reconocimiento de comandos autoalojada sin API en la nube
Etiquetas
sttofflinedeepspeechedge