context.vn

Small Model Hub

3,378 efficient AI models across 7 domains · Charts · API

ScoreRaw benchmark score — scale varies by task
Showing 91 models
#ModelDomainTaskParams ↑GFLOPsVRAMScoreSpeedArchSource
1
nvidia/stt_en_conformer_ctc_small
SpeechSpeech Recognition10.0M24 MB
6258 RTFxConformer-based/CTCOpen ASR
2
nvidia/stt_en_conformer_transducer_small
SpeechSpeech Recognition14.0M34 MB
5557 RTFxConformer-based/TDT / RNN-TOpen ASR
3
abr-ai/niagara-19m-batch.en
SpeechSpeech Recognition20.0M48 MB
3735 RTFxOpen ASR
4
usefulsensors/moonshine-streaming-tiny
SpeechSpeech Recognition30.0M72 MB
4375 RTFxCustom/TransformerOpen ASR
5
usefulsensors/moonshine-tiny
SpeechSpeech Recognition30.0M72 MB
3733 RTFxCustom/TransformerOpen ASR
6
abr-ai/niagara-38m-batch.en
SpeechSpeech Recognition38.0M91 MB
4049 RTFxOpen ASR
7
usefulsensors/moonshine-base
SpeechSpeech Recognition60.0M144 MB
2767 RTFxCustom/TransformerOpen ASR
8
facebook/data2vec-audio-base-960h
SpeechSpeech Recognition90.0M216 MB
2930 RTFxSelf-supervised/CTCOpen ASR
9
facebook/wav2vec2-base-960h
SpeechSpeech Recognition90.0M216 MB
3366 RTFxSelf-supervised/CTCOpen ASR
10
nvidia/parakeet-tdt_ctc-110m
SpeechSpeech Recognition110.0M264 MB
6119 RTFxConformer-based/"CTCOpen ASR
11
nvidia/stt_en_fastconformer_transducer_large
SpeechSpeech Recognition110.0M264 MB
6033 RTFxConformer-based/TDT / RNN-TOpen ASR
12
nvidia/stt_en_conformer_ctc_large
SpeechSpeech Recognition120.0M288 MB
5732 RTFxConformer-based/CTCOpen ASR
13
nvidia/stt_en_fastconformer_ctc_large
SpeechSpeech Recognition120.0M288 MB
6027 RTFxConformer-based/CTCOpen ASR
14
usefulsensors/moonshine-streaming-small
SpeechSpeech Recognition120.0M288 MB
3206 RTFxCustom/TransformerOpen ASR
15
nvidia/canary-180m-flash
SpeechSpeech Recognition180.0M432 MB
2484 RTFxConformer-based/TransformerOpen ASR
16
usefulsensors/moonshine-streaming-medium
SpeechSpeech Recognition240.0M576 MB
2681 RTFxCustom/TransformerOpen ASR
17
soundsgoodai/Zipformer-cr-ctc-transducer-XL-290M
SpeechSpeech Recognition290.0M696 MB
160 RTFxZipformer/Pruned Stateless Transducer with k2 modified_beam_searchOpen ASR
18
soundsgoodai/Zipformer-transducer-XL-290M
SpeechSpeech Recognition290.0M696 MB
141 RTFxZipformer/RNN-TOpen ASR
19
facebook/wav2vec2-large-robust-ft-libri-960h
SpeechSpeech Recognition300.0M720 MB
3058 RTFxSelf-supervised/CTCOpen ASR
20
facebook/data2vec-audio-large-960h
SpeechSpeech Recognition310.0M744 MB
2374 RTFxSelf-supervised/CTCOpen ASR
21
facebook/hubert-large-ls960-ft
SpeechSpeech Recognition320.0M768 MB
3024 RTFxSelf-supervised/CTCOpen ASR
22
facebook/wav2vec2-large-960h
SpeechSpeech Recognition320.0M768 MB
3614 RTFxSelf-supervised/CTCOpen ASR
23
facebook/wav2vec2-large-960h-lv60-self
SpeechSpeech Recognition320.0M768 MB
3010 RTFxSelf-supervised/CTCOpen ASR
24
speechbrain/asr-wav2vec2-librispeech
SpeechSpeech Recognition320.0M768 MB
3628 RTFxSelf-supervised/CTCOpen ASR
25
AutoArk-AI/Audio8-ASR-0.1B
SpeechSpeech Recognition324.0M778 MB
709 RTFxQwen3-ASR audio encoder/8-layer Qwen-style causal LMOpen ASR
26
speechbrain/asr-conformer-largescaleasr
SpeechSpeech Recognition480.0M1.1 GB
72 RTFxConformer-based/"TransformerOpen ASR
27
facebook/wav2vec2-conformer-rope-large-960h-ft
SpeechSpeech Recognition600.0M1.4 GB
1723 RTFx"Self-supervised/Conformer-based"Open ASR
28
nvidia/parakeet-ctc-0.6b
SpeechSpeech Recognition600.0M1.4 GB
5884 RTFxConformer-based/CTCOpen ASR
29
nvidia/parakeet-rnnt-0.6b
SpeechSpeech Recognition600.0M1.4 GB
5407 RTFxConformer-based/TDT / RNN-TOpen ASR
30
nvidia/parakeet-tdt-0.6b-v2
SpeechSpeech Recognition600.0M1.4 GB
6038 RTFxConformer-based/TDT / RNN-TOpen ASR
31
nvidia/parakeet-tdt-0.6b-v3
SpeechSpeech Recognition600.0M1.4 GB
6098 RTFxConformer-based/TDT / RNN-TOpen ASR
32
facebook/wav2vec2-conformer-rel-pos-large-960h-ft
SpeechSpeech Recognition620.0M1.5 GB
1415 RTFx"Self-supervised/Conformer-based"Open ASR
33
nvidia/nemotron-speech-streaming-en-0.6b
SpeechSpeech Recognition620.0M1.5 GB
1071 RTFxFastConformer (cache-aware)/RNNTOpen ASR
34
nvidia/nemotron-3.5-asr-streaming-0.6b
SpeechSpeech Recognition640.0M1.5 GB
1490 RTFxFastConformer (cache-aware)/RNNTOpen ASR
35
efficient-speech/lite-whisper-large-v3-turbo-acc
SpeechSpeech Recognition700.0M1.6 GB
327 RTFxWhisper/TransformerOpen ASR
36
Qwen/Qwen3-ASR-0.6B
SpeechSpeech Recognition780.0M1.8 GB
439 RTFxCustom/Qwen3Open ASR
37
Qwen/Qwen3-ASR-0.6B-hf
SpeechSpeech Recognition780.0M1.8 GB
730 RTFxCustom/Qwen3Open ASR
38
distil-whisper/distil-large-v3.5
SpeechSpeech Recognition800.0M1.9 GB
874 RTFxWhisper/TransformerOpen ASR
39
openai/whisper-large-v3-turbo
SpeechSpeech Recognition800.0M1.9 GB
783 RTFxWhisper/TransformerOpen ASR
40
facebook/hubert-xlarge-ls960-ft
SpeechSpeech Recognition960.0M2.3 GB
1980 RTFxSelf-supervised/CTCOpen ASR
41
facebook/mms-1b-all
SpeechSpeech Recognition960.0M2.3 GB
1954 RTFxSelf-supervised/CTCOpen ASR
42
efficient-speech/lite-whisper-large-v3
SpeechSpeech Recognition1.0B2.3 GB
212 RTFxWhisper/TransformerOpen ASR
43
efficient-speech/lite-whisper-large-v3-acc
SpeechSpeech Recognition1.0B2.3 GB
204 RTFxWhisper/TransformerOpen ASR
44
efficient-speech/lite-whisper-large-v3-fast
SpeechSpeech Recognition1.0B2.3 GB
212 RTFxWhisper/TransformerOpen ASR
45
espnet/owsm_ctc_v3.2_ft_1B
SpeechSpeech Recognition1.0B2.3 GB
692 RTFxWhisper/CTCOpen ASR
46
espnet/owsm_ctc_v4_1B
SpeechSpeech Recognition1.0B2.3 GB
765 RTFxWhisper/CTCOpen ASR
47
nvidia/canary-1b
SpeechSpeech Recognition1.0B2.3 GB
766 RTFxConformer-based/TransformerOpen ASR
48
nvidia/canary-1b-flash
SpeechSpeech Recognition1.0B2.3 GB
2126 RTFxConformer-based/TransformerOpen ASR
49
nvidia/canary-1b-v2
SpeechSpeech Recognition1.0B2.3 GB
1821 RTFxConformer-based/TransformerOpen ASR
50
espnet/owsm_ctc_v3.1_1B
SpeechSpeech Recognition1.1B2.6 GB
816 RTFxWhisper/CTCOpen ASR
51
nvidia/parakeet-ctc-1.1b
SpeechSpeech Recognition1.1B2.6 GB
5015 RTFxConformer-based/CTCOpen ASR
52
nvidia/parakeet-rnnt-1.1b
SpeechSpeech Recognition1.1B2.6 GB
4122 RTFxConformer-based/TDT / RNN-TOpen ASR
53
nvidia/parakeet-tdt-1.1b
SpeechSpeech Recognition1.1B2.6 GB
4529 RTFxConformer-based/TDT / RNN-TOpen ASR
54
AutoArk-AI/ARK-ASR-0.6B
SpeechSpeech Recognition1.1B2.7 GB
672 RTFxWhisper/Qwen2Open ASR
55
CohereLabs/cohere-transcribe-03-2026
SpeechSpeech Recognition2.0B4.7 GB
916 RTFxConformer-based/TransformerOpen ASR
56
ibm-granite/granite-4.0-1b-speech
SpeechSpeech Recognition2.0B4.7 GB
661 RTFxConformer-based/GraniteOpen ASR
57
ibm-granite/granite-speech-4.1-2b
SpeechSpeech Recognition2.0B4.7 GB
547 RTFxConformer-based/GraniteOpen ASR
58
ibm-granite/granite-speech-4.1-2b-nar
SpeechSpeech Recognition2.0B4.7 GB
2079 RTFxConformer-based/Hybrid CTC-LLMOpen ASR
59
nyrahealth/CrisperWhisper
SpeechSpeech Recognition2.0B4.7 GB
33 RTFxWhisper/TransformerOpen ASR
60
openai/whisper-large-v3
SpeechSpeech Recognition2.0B4.7 GB
462 RTFxWhisper/TransformerOpen ASR
61
zai-org/GLM-ASR-Nano-2512
SpeechSpeech Recognition2.0B4.7 GB
333 RTFxWhisper/LlamaOpen ASR
62
Qwen/Qwen3-ASR-1.7B
SpeechSpeech Recognition2.0B4.8 GB
394 RTFxCustom/Qwen3Open ASR
63
Qwen/Qwen3-ASR-1.7B-hf
SpeechSpeech Recognition2.0B4.8 GB
796 RTFxCustom/Qwen3Open ASR
64
OpenMOSS-Team/MOSS-Transcribe-preview-2B
SpeechSpeech Recognition2.4B5.7 GB
149 RTFxQwen3-Omni-MoE audio encoder/Qwen3Open ASR
65
nvidia/canary-qwen-2.5b
SpeechSpeech Recognition2.5B5.9 GB
861 RTFxConformer-based/Qwen2Open ASR
66
kyutai/stt-2.6b-en
SpeechSpeech Recognition2.6B6.1 GB
133 RTFxMimi tokenizer/TransformerOpen ASR
67
bosonai/higgs-audio-v3-stt
SpeechSpeech Recognition2.7B6.3 GB
110 RTFxWhisper/Qwen3Open ASR
68
ibm-granite/granite-speech-3.3-2b
SpeechSpeech Recognition3.0B7.0 GB
507 RTFxConformer-based/GraniteOpen ASR
69
AutoArk-AI/ARK-ASR-3B
SpeechSpeech Recognition3.8B8.8 GB
484 RTFxWhisper/Qwen2Open ASR
70
mistralai/Voxtral-Mini-4B-Realtime-2602
SpeechSpeech Recognition4.0B9.4 GB
105 RTFxCustom/TransformerOpen ASR
71
mistralai/Voxtral-Mini-3B-2507
SpeechSpeech Recognition5.0B11.7 GB
180 RTFxWhisper/Ministral 3BOpen ASR
72
HojoAI/Hojo-ASR-V1
SpeechSpeech Recognition5.2B12.1 GB
74 RTFxQwen3-Omni encoder/Qwen3-4BOpen ASR
73
microsoft/Phi-4-multimodal-instruct
SpeechSpeech Recognition6.0B14.1 GB
163 RTFxConformer-based/Phi-4-Mini-InstructOpen ASR
74
facebook/omniASR-CTC-7B-v2
SpeechSpeech Recognition6.5B15.2 GB
528 RTFxSelf-supervised/CTCOpen ASR
75
facebook/omniASR-LLM-7B-v2
SpeechSpeech Recognition7.8B18.3 GB
143 RTFxSelf-supervised/TransformerOpen ASR
76
microsoft/VibeVoice-ASR-HF
SpeechSpeech Recognition8.0B18.8 GB
221 RTFxCustom/Qwen2Open ASR
77
bosonai/higgs-audio-v3-8b-stt-v2
SpeechSpeech Recognition8.9B20.9 GB
139 RTFxWhisper/Qwen3Open ASR
78
ibm-granite/granite-speech-3.3-8b
SpeechSpeech Recognition9.0B21.1 GB
264 RTFxConformer-based/GraniteOpen ASR
79
mistralai/Voxtral-Small-24B-2507
SpeechSpeech Recognition24.0B56.3 GB
100 RTFxWhisper/Ministral 24BOpen ASR
80
aquavoice/avalon-v1-en
SpeechSpeech Recognition
Open ASR
81
assemblyai/universal-3-5-pro
SpeechSpeech Recognition
Open ASR
82
assemblyai/universal-3-pro
SpeechSpeech Recognition
Open ASR
83
elevenlabs/scribe_v2
SpeechSpeech Recognition
Open ASR
84
gladia/solaria-3
SpeechSpeech Recognition
Open ASR
85
microsoft/azure-speech-06-2026
SpeechSpeech Recognition
Open ASR
86
modulate/vfast
SpeechSpeech Recognition
Open ASR
87
reson8/resonant-1
SpeechSpeech Recognition
Open ASR
88
reson8/resonant-1-flash
SpeechSpeech Recognition
Open ASR
89
smallestai/pulse
SpeechSpeech Recognition
Open ASR
90
speechmatics/enhanced
SpeechSpeech Recognition
Open ASR
91
zoom/scribe_v1
SpeechSpeech Recognition
Open ASR