Kostenlose APIVision & SpracheAPI-SchlüsselOffiziell
AssemblyAI
50 $ kostenlose Credits, keine Kreditkarte; Speech-to-Text plus LeMUR-LLM-Audio-Intelligence
AssemblyAI ist eine Speech-to-Text-API mit Batch- und Streaming-Transkription sowie Audio-Intelligence-Erweiterungen: Speaker-Diarization, Entity-/Topic-Detection, Zusammenfassung und das LeMUR-Framework zum Ausführen von LLM-Prompts über Transkripte. Audio wird per URL eingereicht oder hochgeladen, die Transcript-ID gepollt und dann das Ergebnis abgerufen.
Free Tier
50 $ einmaliges kostenloses Guthaben, keine Kreditkarte (~333 Stunden auf Universal-2 zu 0,15 $/Stunde); danach Pay-as-you-goRatenlimits
~5 parallele Transkriptionen bei kostenlosem/PAYG-Tarif; weitere Dateien werden in die Warteschlange gestellt, anstatt parallel zu laufenAuth
API-SchlüsselBasis-URL
https://api.assemblyai.comWas du damit bauen kannst
- Gesprächsaufzeichnungen in einer Automation transkribieren und zusammenfassen
- LeMUR-LLM-Prompts ('Was waren die Aktionspunkte?') über ein Transkript ausführen
- Sprecher und Themen automatisch erkennen für ein Meeting-Notizen-Skill
Wichtige Endpunkte
- POST
/v2/transcriptAudio (per URL) zur Transkription einreichen, gibt eine Transcript-ID zurück - GET
/v2/transcript/{id}Ein Transkript per ID auf Status und finalen Text pollen - POST
/v2/uploadEine lokale Audiodatei vor der Transkription hochladen
Mitglieder
Mitglieder erhalten das ausführbare Rezept
Melde dich kostenlos an, um die Beispielanfrage zu kopieren, eine Beispielantwort zu sehen und die Stolperfallen zu lesen.
Tags
speech-to-textaudiotranscriptionllmvoice