context.vn
Menu

Small Model Hub

3,618 efficient AI models across 9 domains · Charts · API

ScoreRaw benchmark score — scale varies by task
Showing 67 models
#ModelDomainTaskParams ↑GFLOPsVRAMScoreSpeedArchSource
1
abr-ai/niagara-9m-batch.en
SpeechSpeech Recognition9.00M—22 MB
——
7158 RTFxState-space model/CTCOpen ASR
2
abr-ai/niagara-19m-batch.en
SpeechSpeech Recognition20.0M—48 MB
——
4324 RTFxState-space model/CTCOpen ASR
3
abr-ai/niagara-38m-batch.en
SpeechSpeech Recognition38.0M—91 MB
——
4015 RTFx—Open ASR
4
nvidia/canary-180m-flash
SpeechSpeech Recognition180.0M—432 MB
——
2489 RTFxConformer-based/TransformerOpen ASR
5
soundsgoodai/Zipformer-cr-ctc-transducer-XL-290M
SpeechSpeech Recognition290.0M—696 MB
——
158 RTFxZipformer/Pruned Stateless Transducer with k2 modified_beam_searchOpen ASR
6
soundsgoodai/Zipformer-transducer-XL-290M
SpeechSpeech Recognition290.0M—696 MB
——
141 RTFxZipformer/RNN-TOpen ASR
7
AutoArk-AI/Audio8-ASR-0.1B
SpeechSpeech Recognition324.0M—778 MB
——
719 RTFxQwen3-ASR audio encoder/8-layer Qwen-style causal LMOpen ASR
8
ibm-granite/granite-speech-5.0-470m-turboctc
SpeechSpeech Recognition470.0M—1.1 GB
——
12946 RTFxStreaming-style Conformer/CTCOpen ASR
9
ibm-granite/granite-speech-5.0-470m-turboctc-nc
SpeechSpeech Recognition470.0M—1.1 GB
——
12762 RTFxStreaming-style Conformer/CTCOpen ASR
10
nvidia/parakeet-ctc-0.6b
SpeechSpeech Recognition600.0M—1.4 GB
——
5870 RTFxConformer-based/CTCOpen ASR
11
nvidia/parakeet-rnnt-0.6b
SpeechSpeech Recognition600.0M—1.4 GB
——
5431 RTFxConformer-based/TDT / RNN-TOpen ASR
12
nvidia/parakeet-tdt-0.6b-v2
SpeechSpeech Recognition600.0M—1.4 GB
——
6025 RTFxConformer-based/TDT / RNN-TOpen ASR
13
nvidia/parakeet-tdt-0.6b-v3
SpeechSpeech Recognition600.0M—1.4 GB
——
6076 RTFxConformer-based/TDT / RNN-TOpen ASR
14
nvidia/nemotron-speech-streaming-en-0.6b
SpeechSpeech Recognition620.0M—1.5 GB
——
1167 RTFxFastConformer (cache-aware)/RNNTOpen ASR
15
nvidia/nemotron-3.5-asr-streaming-0.6b
SpeechSpeech Recognition640.0M—1.5 GB
——
1345 RTFxFastConformer (cache-aware)/RNNTOpen ASR
16
Qwen/Qwen3-ASR-0.6B-hf
SpeechSpeech Recognition780.0M—1.8 GB
——
744 RTFxCustom/Qwen3Open ASR
17
distil-whisper/distil-large-v3.5
SpeechSpeech Recognition800.0M—1.9 GB
——
879 RTFxWhisper/TransformerOpen ASR
18
openai/whisper-large-v3-turbo
SpeechSpeech Recognition800.0M—1.9 GB
——
797 RTFxWhisper/TransformerOpen ASR
19
FunAudioLLM/Fun-ASR-Nano-2512-hf
SpeechSpeech Recognition830.0M—1.9 GB
——
497 RTFxQwen3-ASR/CustomOpen ASR
20
OpenMOSS-Team/MOSS-Transcribe-Diarize
SpeechSpeech Recognition910.0M—2.1 GB
——
381 RTFx"Whisper audio encoder/24 layers"Open ASR
21
espnet/owsm_ctc_v4_1B
SpeechSpeech Recognition1.0B—2.3 GB
——
777 RTFxWhisper/CTCOpen ASR
22
nvidia/canary-1b
SpeechSpeech Recognition1.0B—2.3 GB
——
767 RTFxConformer-based/TransformerOpen ASR
23
nvidia/canary-1b-flash
SpeechSpeech Recognition1.0B—2.3 GB
——
2129 RTFxConformer-based/TransformerOpen ASR
24
nvidia/canary-1b-v2
SpeechSpeech Recognition1.0B—2.3 GB
——
1825 RTFxConformer-based/TransformerOpen ASR
25
nvidia/parakeet-ctc-1.1b
SpeechSpeech Recognition1.1B—2.6 GB
——
5023 RTFxConformer-based/CTCOpen ASR
26
nvidia/parakeet-rnnt-1.1b
SpeechSpeech Recognition1.1B—2.6 GB
——
4139 RTFxConformer-based/TDT / RNN-TOpen ASR
27
AutoArk-AI/ARK-ASR-0.6B
SpeechSpeech Recognition1.1B—2.7 GB
——
663 RTFxWhisper/Qwen2Open ASR
28
CohereLabs/cohere-transcribe-03-2026
SpeechSpeech Recognition2.0B—4.7 GB
——
907 RTFxConformer-based/TransformerOpen ASR
29
ibm-granite/granite-4.0-1b-speech
SpeechSpeech Recognition2.0B—4.7 GB
——
666 RTFxConformer-based/GraniteOpen ASR
30
ibm-granite/granite-speech-4.1-2b
SpeechSpeech Recognition2.0B—4.7 GB
——
546 RTFxConformer-based/GraniteOpen ASR
31
ibm-granite/granite-speech-4.1-2b-nar
SpeechSpeech Recognition2.0B—4.7 GB
——
2074 RTFxConformer-based/Hybrid CTC-LLMOpen ASR
32
openai/whisper-large-v3
SpeechSpeech Recognition2.0B—4.7 GB
——
470 RTFxWhisper/TransformerOpen ASR
33
zai-org/GLM-ASR-Nano-2512
SpeechSpeech Recognition2.0B—4.7 GB
——
334 RTFxWhisper/LlamaOpen ASR
34
Qwen/Qwen3-ASR-1.7B-hf
SpeechSpeech Recognition2.0B—4.8 GB
——
820 RTFxCustom/Qwen3Open ASR
35
OpenMOSS-Team/MOSS-Transcribe-preview-2B
SpeechSpeech Recognition2.4B—5.7 GB
——
151 RTFxQwen3-Omni-MoE audio encoder/Qwen3Open ASR
36
nvidia/canary-qwen-2.5b
SpeechSpeech Recognition2.5B—5.9 GB
——
867 RTFxConformer-based/Qwen2Open ASR
37
kyutai/stt-2.6b-en
SpeechSpeech Recognition2.6B—6.1 GB
——
133 RTFxMimi tokenizer/TransformerOpen ASR
38
bosonai/higgs-audio-v3-stt
SpeechSpeech Recognition2.7B—6.3 GB
——
111 RTFxWhisper/Qwen3Open ASR
39
ibm-granite/granite-speech-3.3-2b
SpeechSpeech Recognition3.0B—7.0 GB
——
509 RTFxConformer-based/GraniteOpen ASR
40
AutoArk-AI/ARK-ASR-3B
SpeechSpeech Recognition3.8B—8.8 GB
——
481 RTFxWhisper/Qwen2Open ASR
41
mistralai/Voxtral-Mini-4B-Realtime-2602
SpeechSpeech Recognition4.0B—9.4 GB
——
103 RTFxCustom/TransformerOpen ASR
42
mistralai/Voxtral-Mini-3B-2507
SpeechSpeech Recognition5.0B—11.7 GB
——
181 RTFxWhisper/Ministral 3BOpen ASR
43
HojoAI/Hojo-ASR-V1
SpeechSpeech Recognition5.2B—12.1 GB
——
73 RTFxQwen3-Omni encoder/Qwen3-4BOpen ASR
44
microsoft/Phi-4-multimodal-instruct
SpeechSpeech Recognition6.0B—14.1 GB
——
163 RTFxConformer-based/Phi-4-Mini-InstructOpen ASR
45
facebook/omniASR-CTC-7B-v2
SpeechSpeech Recognition6.5B—15.2 GB
——
519 RTFxSelf-supervised/CTCOpen ASR
46
facebook/omniASR-LLM-7B-v2
SpeechSpeech Recognition7.8B—18.3 GB
——
129 RTFxSelf-supervised/TransformerOpen ASR
47
google/gemma-4-E4B-it
SpeechSpeech Recognition7.9B—18.6 GB
——
161 RTFxConformer/TransformerOpen ASR
48
microsoft/VibeVoice-ASR-HF
SpeechSpeech Recognition8.0B—18.8 GB
——
219 RTFxCustom/Qwen2Open ASR
49
bosonai/higgs-audio-v3-8b-stt-v2
SpeechSpeech Recognition8.9B—20.9 GB
——
137 RTFxWhisper/Qwen3Open ASR
50
ibm-granite/granite-speech-3.3-8b
SpeechSpeech Recognition9.0B—21.1 GB
——
263 RTFxConformer-based/GraniteOpen ASR
51
mistralai/Voxtral-Small-24B-2507
SpeechSpeech Recognition24.0B—56.3 GB
——
101 RTFxWhisper/Ministral 24BOpen ASR
52
assemblyai/universal-3-5-pro
SpeechSpeech Recognition———
——
——Open ASR
53
elevenlabs/scribe_v2
SpeechSpeech Recognition———
——
——Open ASR
54
gladia/solaria-3
SpeechSpeech Recognition———
——
——Open ASR
55
google/gemma-4-12B-it
SpeechSpeech Recognition———
——
106 RTFx—Open ASR
56
google/gemma-4-E2B-it
SpeechSpeech Recognition———
——
191 RTFxConformer/TransformerOpen ASR
57
meta/muse-voice-transcribe
SpeechSpeech Recognition———
——
——Open ASR
58
microsoft/azure-speech-06-2026
SpeechSpeech Recognition———
——
——Open ASR
59
microsoft/azure-speech-07-2026
SpeechSpeech Recognition———
——
——Open ASR
60
modulate/multilingual
SpeechSpeech Recognition———
——
——Open ASR
61
reson8/resonant-1
SpeechSpeech Recognition———
——
——Open ASR
62
reson8/resonant-1-flash
SpeechSpeech Recognition———
——
——Open ASR
63
smallestai/pulse
SpeechSpeech Recognition———
——
——Open ASR
64
sophea/asr-k1 (preview)
SpeechSpeech Recognition———
——
——Open ASR
65
speechmatics/enhanced
SpeechSpeech Recognition———
——
——Open ASR
66
zoom/scribe_v1
SpeechSpeech Recognition———
——
——Open ASR
67
zoom/scribe_v2_pro
SpeechSpeech Recognition———
——
——Open ASR