Todo el código abierto
Código abiertoVoz y medios17k

faster-whisper

Reimplementación de Whisper con CTranslate2 a ~4x de velocidad y menor uso de memoria.

faster-whisper es una reimplementación de la inferencia de Whisper de OpenAI usando el motor CTranslate2, que ofrece una transcripción sustancialmente más rápida con menor uso de memoria y la misma precisión. Admite cuantización (p. ej. int8) y ejecución eficiente tanto en CPU como en GPU, lo que lo convierte en un backend habitual para herramientas basadas en Whisper.

Repositorio

SYSTRAN/faster-whisper

Lenguaje

Python

Lo que construirías con esto

  • Ejecutar la transcripción de Whisper de forma más rápida y económica en servicios de voz a texto en producción
  • Desplegar reconocimiento de voz en hardware con recursos limitados o solo CPU mediante modelos cuantizados
  • Actuar como backend de transcripción dentro de pipelines de voz o agentes de mayor envergadura

Etiquetas

sttfastself-hosted