Todo el código abierto
Código abiertoVoz y medios2.5k

Coqui STT

Motor de reconocimiento de voz por deep learning que funciona sin conexión en una amplia gama de dispositivos.

Coqui STT es un motor de reconocimiento de voz de código abierto descendiente de Mozilla DeepSpeech, diseñado para funcionar con suficiente rapidez para uso en tiempo real en dispositivos que van desde centros de datos hasta una Raspberry Pi. Incluye modelos preentrenados en varios idiomas, además de herramientas para entrenar y ajustar modelos acústicos personalizados para vocabularios de dominios específicos.

Repositorio

coqui-ai/STT

Lenguaje

C++

Lo que construirías con esto

  • Añadir transcripción de voz totalmente sin conexión y respetuosa con la privacidad a aplicaciones embebidas o de edge
  • Ajustar un modelo STT personalizado para un vocabulario de dominio especializado o acento concreto
  • Construir una capa de dictado o reconocimiento de comandos autoalojada sin API en la nube

Etiquetas

sttofflinedeepspeechedge