API gratuitaVisione e voceChiave APIUfficiale
AssemblyAI
$50 in crediti gratuiti, senza carta; speech-to-text più intelligenza audio LeMUR con LLM
AssemblyAI è un'API speech-to-text con trascrizione batch e streaming, più add-on di intelligenza audio: diarizzazione degli speaker, rilevamento entità/topic, riepilogo e il framework LeMUR per eseguire prompt LLM sui trascritti. Si invia l'audio tramite URL o upload, si fa polling sul transcript id, poi si legge il risultato.
Piano gratuito
$50 di credito gratuito una-tantum, senza carta (~333 ore su Universal-2 a $0,15/ora); poi pay-as-you-goLimiti di frequenza
~5 trascrizioni concorrenti su account free/PAYG; i file aggiuntivi vengono messi in coda anziché eseguiti in paralleloAutenticazione
Chiave APIURL base
https://api.assemblyai.comCosa puoi costruirci
- Trascrivere e riassumere registrazioni di chiamate in un'automazione
- Eseguire prompt LLM LeMUR ('quali erano i punti d'azione?') su un trascritto
- Rilevare automaticamente speaker e topic per una Skill di note di riunione
Endpoint principali
- POST
/v2/transcriptInvia audio (tramite URL) per la trascrizione, restituisce un transcript id - GET
/v2/transcript/{id}Interroga un trascritto tramite id per lo stato e il testo finale - POST
/v2/uploadCarica un file audio locale prima della trascrizione
Membri
I membri ottengono la ricetta eseguibile
Accedi gratuitamente per copiare la richiesta di esempio, vedere una risposta di esempio e leggere le insidie.
Tag
speech-to-textaudiotranscriptionllmvoice