DatasetLwaziANV

← Back to examples

How do the models score overall?

Two industry-standard measures, plus latency, across every model in the benchmark. Numbers come from the full evaluation set (612 isiZulu clips from Lwazi ASR Corpus).

< 15% — Excellent 15–30% — Good 30–50% — Rough > 50% — Struggling
� Model Size vs Performance

How does model size relate to WER?

� Word Error Rate (WER)

Percentage of words the model got wrong. Lower is better.

ModelWERNErrors
badrex/w2v-bert-2.0-zulu-asrOpen73.9%6120
facebook/omniASR-LLM-7BOpen76.4%6120
facebook/omniASR-CTC-7BOpen79.2%6120
facebook/omniASR-LLM-3BOpen79.8%6120
dsfsi/anv-whisper-large-v3-turbo-anv-zulOpen79.9%6120
facebook/omniASR-LLM-300MOpen80.0%6120
facebook/omniASR-LLM-1BOpen80.9%6120
facebook/omniASR-CTC-1BOpen81.2%6120
facebook/omniASR-CTC-3BOpen82.3%6120
aadel4/omniASR-CTC-1B-v2Open85.4%6120
facebook/omniASR-CTC-300MOpen85.5%6120
sitwala/whisper-large-v3-turbo-anv-zul-250hOpen85.7%6120
aadel4/omniASR-CTC-300M-v2Open86.3%6120
facebook/mms-1b-allOpen92.1%6120
sitwala/whisper-large-v3-turbo-anv-zul-150hOpen94.2%6120
sitwala/whisper-large-v3-turbo-anv-zul-50hOpen106.6%6120
dsfsi/anv-whisper-small-anv-zulu-first-batchOpen138.0%6120
openai/whisper-large-v3Open143.1%6120
sitwala/whisper-large-anv-sotOpen187.8%6120
sitwala/whisper-large-v3-anv-sotOpen210.5%6120
openai/whisper-smallOpen408.5%6120
Average across models116.1%
Best: badrex/w2v-bert-2.0-zulu-asr (73.9%)
🔤 Character Error Rate (CER)

Percentage of individual characters wrong. Lower is better.

ModelCERNErrors
facebook/omniASR-LLM-7BOpen26.9%6120
facebook/omniASR-LLM-3BOpen28.0%6120
facebook/omniASR-LLM-300MOpen28.4%6120
facebook/omniASR-LLM-1BOpen29.7%6120
badrex/w2v-bert-2.0-zulu-asrOpen31.5%6120
facebook/mms-1b-allOpen34.6%6120
aadel4/omniASR-CTC-1B-v2Open36.0%6120
facebook/omniASR-CTC-300MOpen36.1%6120
facebook/omniASR-CTC-3BOpen36.4%6120
facebook/omniASR-CTC-1BOpen37.0%6120
facebook/omniASR-CTC-7BOpen37.5%6120
aadel4/omniASR-CTC-300M-v2Open39.6%6120
dsfsi/anv-whisper-large-v3-turbo-anv-zulOpen40.0%6120
sitwala/whisper-large-v3-turbo-anv-zul-250hOpen43.3%6120
sitwala/whisper-large-v3-turbo-anv-zul-150hOpen53.3%6120
sitwala/whisper-large-v3-turbo-anv-zul-50hOpen62.4%6120
openai/whisper-large-v3Open65.6%6120
sitwala/whisper-large-anv-sotOpen69.4%6120
sitwala/whisper-large-v3-anv-sotOpen71.6%6120
dsfsi/anv-whisper-small-anv-zulu-first-batchOpen85.2%6120
openai/whisper-smallOpen182.5%6120
Average across models51.2%
Best: facebook/omniASR-LLM-7B (26.9%)
⚡ Latency

Average time it takes per sample.

ModelAvg latency (per sample)
aadel4/omniASR-CTC-300M-v2Open0.02s
facebook/mms-1b-allOpen0.02s
aadel4/omniASR-CTC-1B-v2Open0.02s
badrex/w2v-bert-2.0-zulu-asrOpen0.05s
dsfsi/anv-whisper-large-v3-turbo-anv-zulOpen0.05s
sitwala/whisper-large-v3-turbo-anv-zul-50hOpen0.05s
facebook/omniASR-CTC-3BOpen0.05s
sitwala/whisper-large-v3-turbo-anv-zul-250hOpen0.06s
sitwala/whisper-large-v3-turbo-anv-zul-150hOpen0.06s
facebook/omniASR-CTC-300MOpen0.06s
facebook/omniASR-CTC-1BOpen0.11s
dsfsi/anv-whisper-small-anv-zulu-first-batchOpen0.13s
sitwala/whisper-large-anv-sotOpen0.16s
facebook/omniASR-CTC-7BOpen0.19s
openai/whisper-large-v3Open0.20s
sitwala/whisper-large-v3-anv-sotOpen0.20s
openai/whisper-smallOpen0.29s
facebook/omniASR-LLM-1BOpen0.51s
facebook/omniASR-LLM-3BOpen0.52s
facebook/omniASR-LLM-300MOpen0.53s
facebook/omniASR-LLM-7BOpen0.55s
What do these numbers mean?

WER (Word Error Rate): out of every 100 spoken words, how many did the model get wrong?

CER (Character Error Rate): same idea but at the character level.

Lower is always better. 0% would mean a perfect transcription.

← Back to example gallery