Domain
Task
Showing 15 models
| # | Model | Domain | Task | Params ↑ | GFLOPs | VRAM | Score | Speed | Arch | Source |
|---|---|---|---|---|---|---|---|---|---|---|
| 1 | nvidia/stt_en_conformer_ctc_small | Speech | Speech Recognition | 10.0M | — | 24 MB | —— | 6258 RTFx | Conformer-based/CTC | Open ASR |
| 2 | nvidia/stt_en_conformer_transducer_small | Speech | Speech Recognition | 14.0M | — | 34 MB | —— | 5557 RTFx | Conformer-based/TDT / RNN-T | Open ASR |
| 3 | abr-ai/niagara-19m-batch.en | Speech | Speech Recognition | 20.0M | — | 48 MB | —— | 3735 RTFx | — | Open ASR |
| 4 | usefulsensors/moonshine-streaming-tiny | Speech | Speech Recognition | 30.0M | — | 72 MB | —— | 4375 RTFx | Custom/Transformer | Open ASR |
| 5 | usefulsensors/moonshine-tiny | Speech | Speech Recognition | 30.0M | — | 72 MB | —— | 3733 RTFx | Custom/Transformer | Open ASR |
| 6 | abr-ai/niagara-38m-batch.en | Speech | Speech Recognition | 38.0M | — | 91 MB | —— | 4049 RTFx | — | Open ASR |
| 7 | usefulsensors/moonshine-base | Speech | Speech Recognition | 60.0M | — | 144 MB | —— | 2767 RTFx | Custom/Transformer | Open ASR |
| 8 | facebook/data2vec-audio-base-960h | Speech | Speech Recognition | 90.0M | — | 216 MB | —— | 2930 RTFx | Self-supervised/CTC | Open ASR |
| 9 | facebook/wav2vec2-base-960h | Speech | Speech Recognition | 90.0M | — | 216 MB | —— | 3366 RTFx | Self-supervised/CTC | Open ASR |
| 10 | nvidia/parakeet-tdt_ctc-110m | Speech | Speech Recognition | 110.0M | — | 264 MB | —— | 6119 RTFx | Conformer-based/"CTC | Open ASR |
| 11 | nvidia/stt_en_fastconformer_transducer_large | Speech | Speech Recognition | 110.0M | — | 264 MB | —— | 6033 RTFx | Conformer-based/TDT / RNN-T | Open ASR |
| 12 | nvidia/stt_en_conformer_ctc_large | Speech | Speech Recognition | 120.0M | — | 288 MB | —— | 5732 RTFx | Conformer-based/CTC | Open ASR |
| 13 | nvidia/stt_en_fastconformer_ctc_large | Speech | Speech Recognition | 120.0M | — | 288 MB | —— | 6027 RTFx | Conformer-based/CTC | Open ASR |
| 14 | usefulsensors/moonshine-streaming-small | Speech | Speech Recognition | 120.0M | — | 288 MB | —— | 3206 RTFx | Custom/Transformer | Open ASR |
| 15 | nvidia/canary-180m-flash | Speech | Speech Recognition | 180.0M | — | 432 MB | —— | 2484 RTFx | Conformer-based/Transformer | Open ASR |