Open SourceSprache & Medien38k
Bark
Transformer-Text-to-Audio-Modell, das spricht, singt, lacht und Soundeffekte erzeugt.
Bark von Suno ist ein transformerbasiertes Text-to-Audio-Modell, das hochrealistisches mehrsprachiges Sprechen sowie nonverbale KlĂ€nge wie Lachen, Seufzen, Musik und GerĂ€usche generiert. Mit Klammerhinweisen und Sprecher-Presets kann es ausdrucksstarke Vertonungen und Ambient-Audio erzeugen, nicht nur nĂŒchterne Vorlesestimmen.
Repository
suno-ai/barkSprache
PythonWas du damit bauen kannst
- Ausdrucksstarke, emotionale Vertonungen mit Lachen, Pausen und Tonhinweisen generieren
- Mehrsprachige Voiceovers oder Charakterdialoge fĂŒr Spiele und Video produzieren
- Einfache Soundeffekte, Musikschnipsel oder Ambient-Audio aus Text-Prompts erstellen
Tags
ttstext-to-audiomultilingualexpressive