Pre-Recorded Speech-to-Text
High-accuracy transcription with Universal-3 Pro and Universal-2. Supports 100+ languages, speaker diarization, medical mode, and custom prompting.
Production-ready speech-to-text, audio intelligence, and LLM Gateway. Build with pre-recorded or streaming audio using REST APIs and WebSockets.
import assemblyai as aai
aai.settings.api_key = "YOUR_API_KEY"
transcriber = aai.Transcriber()
transcript = transcriber.transcribe("https://example.com/audio.mp3")
print(transcript.text)import { AssemblyAI } from 'assemblyai'
const client = new AssemblyAI({ apiKey: 'YOUR_API_KEY' })
const transcript = await client.transcripts.transcribe({
audio: 'https://example.com/audio.mp3'
})
console.log(transcript.text)curl -X POST https://api.assemblyai.com/v2/transcript \
-H "Authorization: YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"audio_url": "https://example.com/audio.mp3"}'| Model | Use Case | Latency | Languages |
|---|---|---|---|
| Universal-3 Pro (Async) | Highest accuracy, pre-recorded | 15-30% of audio duration | 6 languages |
| Universal-2 | Broad language support | 15-30% of audio duration | 99+ languages |
| Universal-3 Pro Streaming | Real-time, voice agents | Under 300ms | 6 languages |
| Universal Streaming | Real-time, multilingual | Under 500ms | 60+ languages |
| Whisper Streaming | 99+ language streaming | Varies | 99+ languages |