โ† All examples

ModelEthio-ASR Amharic (600M)1Ethio-ASR Multi (300M)2Ethio-ASR Multi (600M)4Ethio-ASR Multi (94M)4Meta MMS-1B7OmniASR-CTC (1B)0OmniASR-CTC (300M)2OmniASR-CTC (3B)0OmniASR-LLM (1B)2OmniASR-LLM (300M)2OmniASR-LLM (3B)2OpenAI Whisper-small7
Audio qualityClean Studio0Ambient Room Noise2Harsh Environment2Distant / Low-Volume Mic0Wideband Phone (VoLTE)3Randomized Phone Channel5Narrowband 2G + Packet Loss5

What did the model get wrong?

OmniASR-LLM (1B) Harsh Environment   Example 14 of 20  ยท  speaker: Male

๐ŸŽง Listen โ€” Harsh Environment
Very heavy background noise โ€” much harder than typical audio.
โœ… What was actually said
แŠฅแˆฝ แ‰ชแ‹ตแ‹ฎ แ‹ˆแ‹ญแˆ แˆ˜แˆ˜แˆชแ‹ซ แŠ แˆˆ แŠฅแŠ•แ‹ฐแ‰ต แŠฅแŠ•แ‹ฐแˆแŒ แ‰€แˆ
๐Ÿค– What this model heard
แŠฅแˆฝ แ‰ชแ‹ตแ‹ฎ แ‹ˆแ‹ญแˆ แˆ˜แˆ˜แˆชแ‹ซ แŠ แˆˆ แŠฅแŠ•แ‹ฐแ‰ต แŠฅแŠ•แ‹ฐแˆ แŒ แ‰€แˆ
Correct
Wrong (different word)
Missed (skipped)
Extra (added)
6
Correct
1
Wrong
0
Missed
1
Extra
86%
Words right
Out of 7 spoken words, this model got 6 right (86%). Errors: 1 word wrong; 1 extra.

Try switching Audio quality โ€” see the same model degrade as the audio gets noisier.