context.vn

Small Model Hub

3,378 efficient AI models across 7 domains · Charts · API

ScoreRaw benchmark score — scale varies by task
Showing 54 models
#ModelDomainTaskParams ↑GFLOPsVRAMScoreSpeedArchSource
1
nvidia/stt_en_conformer_ctc_small
SpeechSpeech Recognition10.0M24 MB
6258 RTFxConformer-based/CTCOpen ASR
2
nvidia/stt_en_conformer_transducer_small
SpeechSpeech Recognition14.0M34 MB
5557 RTFxConformer-based/TDT / RNN-TOpen ASR
3
abr-ai/niagara-19m-batch.en
SpeechSpeech Recognition20.0M48 MB
3735 RTFxOpen ASR
4
usefulsensors/moonshine-streaming-tiny
SpeechSpeech Recognition30.0M72 MB
4375 RTFxCustom/TransformerOpen ASR
5
usefulsensors/moonshine-tiny
SpeechSpeech Recognition30.0M72 MB
3733 RTFxCustom/TransformerOpen ASR
6
abr-ai/niagara-38m-batch.en
SpeechSpeech Recognition38.0M91 MB
4049 RTFxOpen ASR
7
usefulsensors/moonshine-base
SpeechSpeech Recognition60.0M144 MB
2767 RTFxCustom/TransformerOpen ASR
8
facebook/data2vec-audio-base-960h
SpeechSpeech Recognition90.0M216 MB
2930 RTFxSelf-supervised/CTCOpen ASR
9
facebook/wav2vec2-base-960h
SpeechSpeech Recognition90.0M216 MB
3366 RTFxSelf-supervised/CTCOpen ASR
10
nvidia/parakeet-tdt_ctc-110m
SpeechSpeech Recognition110.0M264 MB
6119 RTFxConformer-based/"CTCOpen ASR
11
nvidia/stt_en_fastconformer_transducer_large
SpeechSpeech Recognition110.0M264 MB
6033 RTFxConformer-based/TDT / RNN-TOpen ASR
12
nvidia/stt_en_conformer_ctc_large
SpeechSpeech Recognition120.0M288 MB
5732 RTFxConformer-based/CTCOpen ASR
13
nvidia/stt_en_fastconformer_ctc_large
SpeechSpeech Recognition120.0M288 MB
6027 RTFxConformer-based/CTCOpen ASR
14
usefulsensors/moonshine-streaming-small
SpeechSpeech Recognition120.0M288 MB
3206 RTFxCustom/TransformerOpen ASR
15
nvidia/canary-180m-flash
SpeechSpeech Recognition180.0M432 MB
2484 RTFxConformer-based/TransformerOpen ASR
16
usefulsensors/moonshine-streaming-medium
SpeechSpeech Recognition240.0M576 MB
2681 RTFxCustom/TransformerOpen ASR
17
soundsgoodai/Zipformer-cr-ctc-transducer-XL-290M
SpeechSpeech Recognition290.0M696 MB
160 RTFxZipformer/Pruned Stateless Transducer with k2 modified_beam_searchOpen ASR
18
soundsgoodai/Zipformer-transducer-XL-290M
SpeechSpeech Recognition290.0M696 MB
141 RTFxZipformer/RNN-TOpen ASR
19
facebook/wav2vec2-large-robust-ft-libri-960h
SpeechSpeech Recognition300.0M720 MB
3058 RTFxSelf-supervised/CTCOpen ASR
20
facebook/data2vec-audio-large-960h
SpeechSpeech Recognition310.0M744 MB
2374 RTFxSelf-supervised/CTCOpen ASR
21
facebook/hubert-large-ls960-ft
SpeechSpeech Recognition320.0M768 MB
3024 RTFxSelf-supervised/CTCOpen ASR
22
facebook/wav2vec2-large-960h
SpeechSpeech Recognition320.0M768 MB
3614 RTFxSelf-supervised/CTCOpen ASR
23
facebook/wav2vec2-large-960h-lv60-self
SpeechSpeech Recognition320.0M768 MB
3010 RTFxSelf-supervised/CTCOpen ASR
24
speechbrain/asr-wav2vec2-librispeech
SpeechSpeech Recognition320.0M768 MB
3628 RTFxSelf-supervised/CTCOpen ASR
25
AutoArk-AI/Audio8-ASR-0.1B
SpeechSpeech Recognition324.0M778 MB
709 RTFxQwen3-ASR audio encoder/8-layer Qwen-style causal LMOpen ASR
26
speechbrain/asr-conformer-largescaleasr
SpeechSpeech Recognition480.0M1.1 GB
72 RTFxConformer-based/"TransformerOpen ASR
27
facebook/wav2vec2-conformer-rope-large-960h-ft
SpeechSpeech Recognition600.0M1.4 GB
1723 RTFx"Self-supervised/Conformer-based"Open ASR
28
nvidia/parakeet-ctc-0.6b
SpeechSpeech Recognition600.0M1.4 GB
5884 RTFxConformer-based/CTCOpen ASR
29
nvidia/parakeet-rnnt-0.6b
SpeechSpeech Recognition600.0M1.4 GB
5407 RTFxConformer-based/TDT / RNN-TOpen ASR
30
nvidia/parakeet-tdt-0.6b-v2
SpeechSpeech Recognition600.0M1.4 GB
6038 RTFxConformer-based/TDT / RNN-TOpen ASR
31
nvidia/parakeet-tdt-0.6b-v3
SpeechSpeech Recognition600.0M1.4 GB
6098 RTFxConformer-based/TDT / RNN-TOpen ASR
32
facebook/wav2vec2-conformer-rel-pos-large-960h-ft
SpeechSpeech Recognition620.0M1.5 GB
1415 RTFx"Self-supervised/Conformer-based"Open ASR
33
nvidia/nemotron-speech-streaming-en-0.6b
SpeechSpeech Recognition620.0M1.5 GB
1071 RTFxFastConformer (cache-aware)/RNNTOpen ASR
34
nvidia/nemotron-3.5-asr-streaming-0.6b
SpeechSpeech Recognition640.0M1.5 GB
1490 RTFxFastConformer (cache-aware)/RNNTOpen ASR
35
efficient-speech/lite-whisper-large-v3-turbo-acc
SpeechSpeech Recognition700.0M1.6 GB
327 RTFxWhisper/TransformerOpen ASR
36
Qwen/Qwen3-ASR-0.6B
SpeechSpeech Recognition780.0M1.8 GB
439 RTFxCustom/Qwen3Open ASR
37
Qwen/Qwen3-ASR-0.6B-hf
SpeechSpeech Recognition780.0M1.8 GB
730 RTFxCustom/Qwen3Open ASR
38
distil-whisper/distil-large-v3.5
SpeechSpeech Recognition800.0M1.9 GB
874 RTFxWhisper/TransformerOpen ASR
39
openai/whisper-large-v3-turbo
SpeechSpeech Recognition800.0M1.9 GB
783 RTFxWhisper/TransformerOpen ASR
40
facebook/hubert-xlarge-ls960-ft
SpeechSpeech Recognition960.0M2.3 GB
1980 RTFxSelf-supervised/CTCOpen ASR
41
facebook/mms-1b-all
SpeechSpeech Recognition960.0M2.3 GB
1954 RTFxSelf-supervised/CTCOpen ASR
42
efficient-speech/lite-whisper-large-v3
SpeechSpeech Recognition1.0B2.3 GB
212 RTFxWhisper/TransformerOpen ASR
43
efficient-speech/lite-whisper-large-v3-acc
SpeechSpeech Recognition1.0B2.3 GB
204 RTFxWhisper/TransformerOpen ASR
44
efficient-speech/lite-whisper-large-v3-fast
SpeechSpeech Recognition1.0B2.3 GB
212 RTFxWhisper/TransformerOpen ASR
45
espnet/owsm_ctc_v3.2_ft_1B
SpeechSpeech Recognition1.0B2.3 GB
692 RTFxWhisper/CTCOpen ASR
46
espnet/owsm_ctc_v4_1B
SpeechSpeech Recognition1.0B2.3 GB
765 RTFxWhisper/CTCOpen ASR
47
nvidia/canary-1b
SpeechSpeech Recognition1.0B2.3 GB
766 RTFxConformer-based/TransformerOpen ASR
48
nvidia/canary-1b-flash
SpeechSpeech Recognition1.0B2.3 GB
2126 RTFxConformer-based/TransformerOpen ASR
49
nvidia/canary-1b-v2
SpeechSpeech Recognition1.0B2.3 GB
1821 RTFxConformer-based/TransformerOpen ASR
50
espnet/owsm_ctc_v3.1_1B
SpeechSpeech Recognition1.1B2.6 GB
816 RTFxWhisper/CTCOpen ASR
51
nvidia/parakeet-ctc-1.1b
SpeechSpeech Recognition1.1B2.6 GB
5015 RTFxConformer-based/CTCOpen ASR
52
nvidia/parakeet-rnnt-1.1b
SpeechSpeech Recognition1.1B2.6 GB
4122 RTFxConformer-based/TDT / RNN-TOpen ASR
53
nvidia/parakeet-tdt-1.1b
SpeechSpeech Recognition1.1B2.6 GB
4529 RTFxConformer-based/TDT / RNN-TOpen ASR
54
AutoArk-AI/ARK-ASR-0.6B
SpeechSpeech Recognition1.1B2.7 GB
672 RTFxWhisper/Qwen2Open ASR