Domain
Task
Showing 6 models
| # | Model | Domain | Task | Params ↑ | GFLOPs | VRAM | Context | Speed | Arch | Source |
|---|---|---|---|---|---|---|---|---|---|---|
| 1 | OpenAI-Clip | Multimodal | Image Classification | 150.0M | — | 360 MB | — | — | — | Qualcomm AI Hub |
| 2 | SmolVLM-256M | Multimodal | Vision-Language | 260.0M | — | 624 MB | 5 | — | — | OpenVLM |
| 3 | SmolVLM2-256M | Multimodal | Vision-Language | 260.0M | — | 624 MB | 1 | — | — | OpenVLM |
| 4 | SmolVLM-500M | Multimodal | Vision-Language | 510.0M | — | 1.2 GB | 8 | — | — | OpenVLM |
| 5 | SmolVLM2-500M | Multimodal | Vision-Language | 510.0M | — | 1.2 GB | 7 | — | — | OpenVLM |
| 6 | H2OVL-800M | Multimodal | Vision-Language | 830.0M | — | 1.9 GB | 10 | — | — | OpenVLM |