context.vn
Menu

Small Model Hub

3,618 efficient AI models across 9 domains · Charts · API

ScorePercentile rank within each task — comparable across domains
Showing 44 models
#ModelDomainTaskParams ↑GFLOPsVRAMContextSpeedArchSource
1
Silero-VAD
Speechvoice activity detection0.24M—1 MB———Qualcomm AI Hub
2
YamNet
SpeechImage Classification3.73M—9 MB———Qualcomm AI Hub
3
abr-ai/niagara-9m-batch.en
SpeechSpeech Recognition9.00M—22 MB—7158 RTFxState-space model/CTCOpen ASR
4
abr-ai/niagara-19m-batch.en
SpeechSpeech Recognition20.0M—48 MB—4324 RTFxState-space model/CTCOpen ASR
5
abr-ai/niagara-38m-batch.en
SpeechSpeech Recognition38.0M—91 MB—4015 RTFx—Open ASR
6
DeepSpeech2
SpeechSpeech94.6M—227 MB———Qualcomm AI Hub
7
HuggingFace-WavLM-Base-Plus
SpeechSpeech95.1M—228 MB———Qualcomm AI Hub
8
nvidia/canary-180m-flash
SpeechSpeech Recognition180.0M—432 MB—2489 RTFxConformer-based/TransformerOpen ASR
9
FunASR-Conformer-EN
SpeechSpeech220.0M—528 MB———Qualcomm AI Hub
10
soundsgoodai/Zipformer-cr-ctc-transducer-XL-290M
SpeechSpeech Recognition290.0M—696 MB—158 RTFxZipformer/Pruned Stateless Transducer with k2 modified_beam_searchOpen ASR
11
soundsgoodai/Zipformer-transducer-XL-290M
SpeechSpeech Recognition290.0M—696 MB—141 RTFxZipformer/RNN-TOpen ASR
12
AutoArk-AI/Audio8-ASR-0.1B
SpeechSpeech Recognition324.0M—778 MB—719 RTFxQwen3-ASR audio encoder/8-layer Qwen-style causal LMOpen ASR
13
ibm-granite/granite-speech-5.0-470m-turboctc
SpeechSpeech Recognition470.0M—1.1 GB—12946 RTFxStreaming-style Conformer/CTCOpen ASR
14
ibm-granite/granite-speech-5.0-470m-turboctc-nc
SpeechSpeech Recognition470.0M—1.1 GB—12762 RTFxStreaming-style Conformer/CTCOpen ASR
15
nvidia/parakeet-ctc-0.6b
SpeechSpeech Recognition600.0M—1.4 GB—5870 RTFxConformer-based/CTCOpen ASR
16
nvidia/parakeet-rnnt-0.6b
SpeechSpeech Recognition600.0M—1.4 GB—5431 RTFxConformer-based/TDT / RNN-TOpen ASR
17
nvidia/parakeet-tdt-0.6b-v2
SpeechSpeech Recognition600.0M—1.4 GB—6025 RTFxConformer-based/TDT / RNN-TOpen ASR
18
nvidia/parakeet-tdt-0.6b-v3
SpeechSpeech Recognition600.0M—1.4 GB—6076 RTFxConformer-based/TDT / RNN-TOpen ASR
19
nvidia/nemotron-speech-streaming-en-0.6b
SpeechSpeech Recognition620.0M—1.5 GB—1167 RTFxFastConformer (cache-aware)/RNNTOpen ASR
20
nvidia/nemotron-3.5-asr-streaming-0.6b
SpeechSpeech Recognition640.0M—1.5 GB—1345 RTFxFastConformer (cache-aware)/RNNTOpen ASR
21
Qwen/Qwen3-ASR-0.6B-hf
SpeechSpeech Recognition780.0M—1.8 GB—744 RTFxCustom/Qwen3Open ASR
22
distil-whisper/distil-large-v3.5
SpeechSpeech Recognition800.0M—1.9 GB—879 RTFxWhisper/TransformerOpen ASR
23
openai/whisper-large-v3-turbo
SpeechSpeech Recognition800.0M—1.9 GB—797 RTFxWhisper/TransformerOpen ASR
24
FunAudioLLM/Fun-ASR-Nano-2512-hf
SpeechSpeech Recognition830.0M—1.9 GB—497 RTFxQwen3-ASR/CustomOpen ASR
25
OpenMOSS-Team/MOSS-Transcribe-Diarize
SpeechSpeech Recognition910.0M—2.1 GB—381 RTFx"Whisper audio encoder/24 layers"Open ASR
26
espnet/owsm_ctc_v4_1B
SpeechSpeech Recognition1.0B—2.3 GB—777 RTFxWhisper/CTCOpen ASR
27
nvidia/canary-1b
SpeechSpeech Recognition1.0B—2.3 GB—767 RTFxConformer-based/TransformerOpen ASR
28
nvidia/canary-1b-flash
SpeechSpeech Recognition1.0B—2.3 GB—2129 RTFxConformer-based/TransformerOpen ASR
29
nvidia/canary-1b-v2
SpeechSpeech Recognition1.0B—2.3 GB—1825 RTFxConformer-based/TransformerOpen ASR
30
nvidia/parakeet-ctc-1.1b
SpeechSpeech Recognition1.1B—2.6 GB—5023 RTFxConformer-based/CTCOpen ASR
31
nvidia/parakeet-rnnt-1.1b
SpeechSpeech Recognition1.1B—2.6 GB—4139 RTFxConformer-based/TDT / RNN-TOpen ASR
32
AutoArk-AI/ARK-ASR-0.6B
SpeechSpeech Recognition1.1B—2.7 GB—663 RTFxWhisper/Qwen2Open ASR
33
CohereLabs/cohere-transcribe-03-2026
SpeechSpeech Recognition2.0B—4.7 GB—907 RTFxConformer-based/TransformerOpen ASR
34
ibm-granite/granite-4.0-1b-speech
SpeechSpeech Recognition2.0B—4.7 GB—666 RTFxConformer-based/GraniteOpen ASR
35
ibm-granite/granite-speech-4.1-2b
SpeechSpeech Recognition2.0B—4.7 GB—546 RTFxConformer-based/GraniteOpen ASR
36
ibm-granite/granite-speech-4.1-2b-nar
SpeechSpeech Recognition2.0B—4.7 GB—2074 RTFxConformer-based/Hybrid CTC-LLMOpen ASR
37
openai/whisper-large-v3
SpeechSpeech Recognition2.0B—4.7 GB—470 RTFxWhisper/TransformerOpen ASR
38
zai-org/GLM-ASR-Nano-2512
SpeechSpeech Recognition2.0B—4.7 GB—334 RTFxWhisper/LlamaOpen ASR
39
Qwen/Qwen3-ASR-1.7B-hf
SpeechSpeech Recognition2.0B—4.8 GB—820 RTFxCustom/Qwen3Open ASR
40
OpenMOSS-Team/MOSS-Transcribe-preview-2B
SpeechSpeech Recognition2.4B—5.7 GB—151 RTFxQwen3-Omni-MoE audio encoder/Qwen3Open ASR
41
nvidia/canary-qwen-2.5b
SpeechSpeech Recognition2.5B—5.9 GB—867 RTFxConformer-based/Qwen2Open ASR
42
kyutai/stt-2.6b-en
SpeechSpeech Recognition2.6B—6.1 GB—133 RTFxMimi tokenizer/TransformerOpen ASR
43
bosonai/higgs-audio-v3-stt
SpeechSpeech Recognition2.7B—6.3 GB—111 RTFxWhisper/Qwen3Open ASR
44
ibm-granite/granite-speech-3.3-2b
SpeechSpeech Recognition3.0B—7.0 GB—509 RTFxConformer-based/GraniteOpen ASR