context.vn
Menu

Small Model Hub

3,618 efficient AI models across 9 domains · Charts · API

ScoreRaw benchmark score — scale varies by task
Showing 19 models
#ModelDomainTaskParams ↑GFLOPsVRAMScoreSpeedArchSource
1
abr-ai/niagara-9m-batch.en
SpeechSpeech Recognition9.00M—22 MB
——
7158 RTFxState-space model/CTCOpen ASR
2
abr-ai/niagara-19m-batch.en
SpeechSpeech Recognition20.0M—48 MB
——
4324 RTFxState-space model/CTCOpen ASR
3
abr-ai/niagara-38m-batch.en
SpeechSpeech Recognition38.0M—91 MB
——
4015 RTFx—Open ASR
4
nvidia/canary-180m-flash
SpeechSpeech Recognition180.0M—432 MB
——
2489 RTFxConformer-based/TransformerOpen ASR
5
soundsgoodai/Zipformer-cr-ctc-transducer-XL-290M
SpeechSpeech Recognition290.0M—696 MB
——
158 RTFxZipformer/Pruned Stateless Transducer with k2 modified_beam_searchOpen ASR
6
soundsgoodai/Zipformer-transducer-XL-290M
SpeechSpeech Recognition290.0M—696 MB
——
141 RTFxZipformer/RNN-TOpen ASR
7
AutoArk-AI/Audio8-ASR-0.1B
SpeechSpeech Recognition324.0M—778 MB
——
719 RTFxQwen3-ASR audio encoder/8-layer Qwen-style causal LMOpen ASR
8
ibm-granite/granite-speech-5.0-470m-turboctc
SpeechSpeech Recognition470.0M—1.1 GB
——
12946 RTFxStreaming-style Conformer/CTCOpen ASR
9
ibm-granite/granite-speech-5.0-470m-turboctc-nc
SpeechSpeech Recognition470.0M—1.1 GB
——
12762 RTFxStreaming-style Conformer/CTCOpen ASR
10
nvidia/parakeet-ctc-0.6b
SpeechSpeech Recognition600.0M—1.4 GB
——
5870 RTFxConformer-based/CTCOpen ASR
11
nvidia/parakeet-rnnt-0.6b
SpeechSpeech Recognition600.0M—1.4 GB
——
5431 RTFxConformer-based/TDT / RNN-TOpen ASR
12
nvidia/parakeet-tdt-0.6b-v2
SpeechSpeech Recognition600.0M—1.4 GB
——
6025 RTFxConformer-based/TDT / RNN-TOpen ASR
13
nvidia/parakeet-tdt-0.6b-v3
SpeechSpeech Recognition600.0M—1.4 GB
——
6076 RTFxConformer-based/TDT / RNN-TOpen ASR
14
nvidia/nemotron-speech-streaming-en-0.6b
SpeechSpeech Recognition620.0M—1.5 GB
——
1167 RTFxFastConformer (cache-aware)/RNNTOpen ASR
15
nvidia/nemotron-3.5-asr-streaming-0.6b
SpeechSpeech Recognition640.0M—1.5 GB
——
1345 RTFxFastConformer (cache-aware)/RNNTOpen ASR
16
Qwen/Qwen3-ASR-0.6B-hf
SpeechSpeech Recognition780.0M—1.8 GB
——
744 RTFxCustom/Qwen3Open ASR
17
distil-whisper/distil-large-v3.5
SpeechSpeech Recognition800.0M—1.9 GB
——
879 RTFxWhisper/TransformerOpen ASR
18
openai/whisper-large-v3-turbo
SpeechSpeech Recognition800.0M—1.9 GB
——
797 RTFxWhisper/TransformerOpen ASR
19
FunAudioLLM/Fun-ASR-Nano-2512-hf
SpeechSpeech Recognition830.0M—1.9 GB
——
497 RTFxQwen3-ASR/CustomOpen ASR