Alle Open Source
Open SourceSprache & Medien38k

Bark

Transformer-Text-to-Audio-Modell, das spricht, singt, lacht und Soundeffekte erzeugt.

Bark von Suno ist ein transformerbasiertes Text-to-Audio-Modell, das hochrealistisches mehrsprachiges Sprechen sowie nonverbale KlĂ€nge wie Lachen, Seufzen, Musik und GerĂ€usche generiert. Mit Klammerhinweisen und Sprecher-Presets kann es ausdrucksstarke Vertonungen und Ambient-Audio erzeugen, nicht nur nĂŒchterne Vorlesestimmen.

Repository

suno-ai/bark

Sprache

Python

Was du damit bauen kannst

  • Ausdrucksstarke, emotionale Vertonungen mit Lachen, Pausen und Tonhinweisen generieren
  • Mehrsprachige Voiceovers oder Charakterdialoge fĂŒr Spiele und Video produzieren
  • Einfache Soundeffekte, Musikschnipsel oder Ambient-Audio aus Text-Prompts erstellen

Tags

ttstext-to-audiomultilingualexpressive