Código abiertoVoz y medios17k
faster-whisper
Reimplementación de Whisper con CTranslate2 a ~4x de velocidad y menor uso de memoria.
faster-whisper es una reimplementación de la inferencia de Whisper de OpenAI usando el motor CTranslate2, que ofrece una transcripción sustancialmente más rápida con menor uso de memoria y la misma precisión. Admite cuantización (p. ej. int8) y ejecución eficiente tanto en CPU como en GPU, lo que lo convierte en un backend habitual para herramientas basadas en Whisper.
Repositorio
SYSTRAN/faster-whisperLenguaje
PythonLo que construirías con esto
- Ejecutar la transcripción de Whisper de forma más rápida y económica en servicios de voz a texto en producción
- Desplegar reconocimiento de voz en hardware con recursos limitados o solo CPU mediante modelos cuantizados
- Actuar como backend de transcripción dentro de pipelines de voz o agentes de mayor envergadura
Etiquetas
sttfastself-hosted