context.vn

Small Model Hub

3,378 efficient AI models across 7 domains · Charts · API

ScorePercentile rank within each task — comparable across domains
Showing 39 models
#ModelDomainTaskParams ↑GFLOPsVRAMContextSpeedArchSource
1
nvidia/stt_en_conformer_ctc_small
SpeechSpeech Recognition10.0M24 MB6258 RTFxConformer-based/CTCOpen ASR
2
nvidia/stt_en_conformer_transducer_small
SpeechSpeech Recognition14.0M34 MB5557 RTFxConformer-based/TDT / RNN-TOpen ASR
3
abr-ai/niagara-19m-batch.en
SpeechSpeech Recognition20.0M48 MB3735 RTFxOpen ASR
4
usefulsensors/moonshine-streaming-tiny
SpeechSpeech Recognition30.0M72 MB4375 RTFxCustom/TransformerOpen ASR
5
usefulsensors/moonshine-tiny
SpeechSpeech Recognition30.0M72 MB3733 RTFxCustom/TransformerOpen ASR
6
abr-ai/niagara-38m-batch.en
SpeechSpeech Recognition38.0M91 MB4049 RTFxOpen ASR
7
usefulsensors/moonshine-base
SpeechSpeech Recognition60.0M144 MB2767 RTFxCustom/TransformerOpen ASR
8
facebook/data2vec-audio-base-960h
SpeechSpeech Recognition90.0M216 MB2930 RTFxSelf-supervised/CTCOpen ASR
9
facebook/wav2vec2-base-960h
SpeechSpeech Recognition90.0M216 MB3366 RTFxSelf-supervised/CTCOpen ASR
10
nvidia/parakeet-tdt_ctc-110m
SpeechSpeech Recognition110.0M264 MB6119 RTFxConformer-based/"CTCOpen ASR
11
nvidia/stt_en_fastconformer_transducer_large
SpeechSpeech Recognition110.0M264 MB6033 RTFxConformer-based/TDT / RNN-TOpen ASR
12
nvidia/stt_en_conformer_ctc_large
SpeechSpeech Recognition120.0M288 MB5732 RTFxConformer-based/CTCOpen ASR
13
nvidia/stt_en_fastconformer_ctc_large
SpeechSpeech Recognition120.0M288 MB6027 RTFxConformer-based/CTCOpen ASR
14
usefulsensors/moonshine-streaming-small
SpeechSpeech Recognition120.0M288 MB3206 RTFxCustom/TransformerOpen ASR
15
nvidia/canary-180m-flash
SpeechSpeech Recognition180.0M432 MB2484 RTFxConformer-based/TransformerOpen ASR
16
usefulsensors/moonshine-streaming-medium
SpeechSpeech Recognition240.0M576 MB2681 RTFxCustom/TransformerOpen ASR
17
soundsgoodai/Zipformer-cr-ctc-transducer-XL-290M
SpeechSpeech Recognition290.0M696 MB160 RTFxZipformer/Pruned Stateless Transducer with k2 modified_beam_searchOpen ASR
18
soundsgoodai/Zipformer-transducer-XL-290M
SpeechSpeech Recognition290.0M696 MB141 RTFxZipformer/RNN-TOpen ASR
19
facebook/wav2vec2-large-robust-ft-libri-960h
SpeechSpeech Recognition300.0M720 MB3058 RTFxSelf-supervised/CTCOpen ASR
20
facebook/data2vec-audio-large-960h
SpeechSpeech Recognition310.0M744 MB2374 RTFxSelf-supervised/CTCOpen ASR
21
facebook/hubert-large-ls960-ft
SpeechSpeech Recognition320.0M768 MB3024 RTFxSelf-supervised/CTCOpen ASR
22
facebook/wav2vec2-large-960h
SpeechSpeech Recognition320.0M768 MB3614 RTFxSelf-supervised/CTCOpen ASR
23
facebook/wav2vec2-large-960h-lv60-self
SpeechSpeech Recognition320.0M768 MB3010 RTFxSelf-supervised/CTCOpen ASR
24
speechbrain/asr-wav2vec2-librispeech
SpeechSpeech Recognition320.0M768 MB3628 RTFxSelf-supervised/CTCOpen ASR
25
AutoArk-AI/Audio8-ASR-0.1B
SpeechSpeech Recognition324.0M778 MB709 RTFxQwen3-ASR audio encoder/8-layer Qwen-style causal LMOpen ASR
26
speechbrain/asr-conformer-largescaleasr
SpeechSpeech Recognition480.0M1.1 GB72 RTFxConformer-based/"TransformerOpen ASR
27
facebook/wav2vec2-conformer-rope-large-960h-ft
SpeechSpeech Recognition600.0M1.4 GB1723 RTFx"Self-supervised/Conformer-based"Open ASR
28
nvidia/parakeet-ctc-0.6b
SpeechSpeech Recognition600.0M1.4 GB5884 RTFxConformer-based/CTCOpen ASR
29
nvidia/parakeet-rnnt-0.6b
SpeechSpeech Recognition600.0M1.4 GB5407 RTFxConformer-based/TDT / RNN-TOpen ASR
30
nvidia/parakeet-tdt-0.6b-v2
SpeechSpeech Recognition600.0M1.4 GB6038 RTFxConformer-based/TDT / RNN-TOpen ASR
31
nvidia/parakeet-tdt-0.6b-v3
SpeechSpeech Recognition600.0M1.4 GB6098 RTFxConformer-based/TDT / RNN-TOpen ASR
32
facebook/wav2vec2-conformer-rel-pos-large-960h-ft
SpeechSpeech Recognition620.0M1.5 GB1415 RTFx"Self-supervised/Conformer-based"Open ASR
33
nvidia/nemotron-speech-streaming-en-0.6b
SpeechSpeech Recognition620.0M1.5 GB1071 RTFxFastConformer (cache-aware)/RNNTOpen ASR
34
nvidia/nemotron-3.5-asr-streaming-0.6b
SpeechSpeech Recognition640.0M1.5 GB1490 RTFxFastConformer (cache-aware)/RNNTOpen ASR
35
efficient-speech/lite-whisper-large-v3-turbo-acc
SpeechSpeech Recognition700.0M1.6 GB327 RTFxWhisper/TransformerOpen ASR
36
Qwen/Qwen3-ASR-0.6B
SpeechSpeech Recognition780.0M1.8 GB439 RTFxCustom/Qwen3Open ASR
37
Qwen/Qwen3-ASR-0.6B-hf
SpeechSpeech Recognition780.0M1.8 GB730 RTFxCustom/Qwen3Open ASR
38
distil-whisper/distil-large-v3.5
SpeechSpeech Recognition800.0M1.9 GB874 RTFxWhisper/TransformerOpen ASR
39
openai/whisper-large-v3-turbo
SpeechSpeech Recognition800.0M1.9 GB783 RTFxWhisper/TransformerOpen ASR