Tout l'open source
Open SourceVoix et médias17k

faster-whisper

Réimplémentation de Whisper via CTranslate2 : environ 4 fois plus rapide, moins de mémoire.

faster-whisper est une réimplémentation de l'inférence Whisper d'OpenAI utilisant le moteur CTranslate2, offrant une transcription nettement plus rapide avec une moindre utilisation mémoire à précision équivalente. Il prend en charge la quantification (par ex. int8) et une exécution efficace sur CPU et GPU, ce qui en fait un backend de remplacement courant pour les outils basés sur Whisper.

Dépôt

SYSTRAN/faster-whisper

Langage

Python

Ce que vous pourriez construire avec

  • Exécuter la transcription Whisper plus rapidement et à moindre coût dans des services de speech-to-text en production
  • Déployer la reconnaissance vocale sur du matériel contraint en ressources ou CPU uniquement via des modèles quantifiés
  • Servir de backend de transcription dans des pipelines voix ou agents plus larges

Tags

sttfastself-hosted