مفتوح المصدرالصوت والوسائط55k
Real-Time Voice Cloning
استنساخ صوت من خمس ثوانٍ من الصوت وتوليف كلام عشوائي في الوقت الفعلي.
Real-Time Voice Cloning هو تطبيق مدروس على نطاق واسع لإطار SV2TTS، يستنسخ صوتًا من نحو خمس ثوانٍ من الصوت المرجعي ويُولّد كلامًا جديدًا به. يجمع بين مُشفّر المتحدث ومُولّد Tacotron ومُرمِّز صوتي، ويظل مرجعًا شائعًا لفهم بنية TTS مُشفِّر-مُولِّد-مُرمِّز.
المستودع
CorentinJ/Real-Time-Voice-Cloningاللغة
Pythonما الذي يمكنك بناؤه به
- نمذجة استنساخ الصوت بأمثلة قليلة لتعلم مسار مُشفِّر/مُولِّد/مُرمِّز
- توليد كلام نموذجي بصوت مستهدف للعروض التوضيحية والتجارب
- دراسة وتكييف تطبيق SV2TTS مرجعي لأعمال الصوت المخصصة
الوسوم
ttsvoice-cloningfew-shotsv2tts