AssemblyAI
communityAI speech-to-text and audio intelligence API for transcription, summarization, and content moderation.
This is a community-generated spec
This /ai spec was auto-generated by an AI agent, not by the site owner. It may be incomplete or inaccurate.
POST
https://api.assemblyai.com/v2/transcriptTranscribe audio or video
Parameters
audio_urlURL of audio file (stringrequiredauto_chaptersgenerate chapters (booleanoptionallanguage_codeISO language code (stringoptionalsummarizationgenerate summary (booleanoptionalspeaker_labelsenable speaker diarization (booleanoptionalReturns
id, status, text, words[] with text, start, end, confidence, speaker, utterances[]GET
https://api.assemblyai.com/v2/transcript/{id}Get transcription status and result
Parameters
idtranscript ID (stringrequiredReturns
id, status, text, words[], utterances[], summary, chapters[], sentiment_analysis_results[]GET
wss://api.assemblyai.com/v2/realtime/wsStream realtime transcription
Parameters
tokentemporary auth token (stringrequiredsample_rateaudio sample rate (integerrequiredReturns
WebSocket stream with message_type, text, words[], audio_start, audio_end, confidence