STT

#ModelOverallWER · batch / streamEnd-of-turn · faster ▸Cost / min
1Smallest AIPulseSmallest AI905.1% / 8.0%183ms †~$0.005
2GPT-4o TranscribeOpenAI872.3% / 5.8%409ms$0.006
3stt-rt-v5Soniox827.5% / 7.3%269ms$0.002
4Grok STTxAI804.8% / 10.9%452ms
5GPT-4o-mini TranscribeOpenAI752.7% / 6.4%679ms$0.003
6Qwen3-ASRAlibaba742.8% / 4.0%710ms
7Nova-3Deepgram749.8% / 12.9%368ms$0.0048
8Gradium ASRGradium7313.7% / 17.6%195ms
9Ink-2Cartesia6311.0% / 9.9%575ms$0.0022
10Chirp 3Google603.9% / 7.4%995ms
11Scribe v2ElevenLabs543.1% / 3.4%1750ms$0.0067
WER · batch / streaminglower is better · faint = live stream
GPT-4o Transcribe2.3% / 5.8%
GPT-4o-mini Transcribe2.7% / 6.4%
Qwen3-ASR2.8% / 4.0%
Scribe v23.1% / 3.4%
Chirp 33.9% / 7.4%
Grok STT4.8% / 10.9%
Smallest AIPulse5.1% / 8.0%
stt-rt-v57.5% / 7.3%
Nova-39.8% / 12.9%
Ink-211.0% / 9.9%
Gradium ASR13.7% / 17.6%
End-of-turn latencyfaster is better
Smallest AIPulse183ms †
Gradium ASR195ms
stt-rt-v5269ms
Nova-3368ms
GPT-4o Transcribe409ms
Grok STT452ms
Ink-2575ms
GPT-4o-mini Transcribe679ms
Qwen3-ASR710ms
Chirp 3995ms
Scribe v21750ms
Cost / mincheaper is better
stt-rt-v5$0.002
Ink-2$0.0022
GPT-4o-mini Transcribe$0.003
Nova-3$0.0048
Smallest AIPulse~$0.005
GPT-4o Transcribe$0.006
Scribe v2$0.0067