1,011 models · refreshed nightly
All models
Every model in the catalog with its licence, estimated VRAM and daily-tracked downloads. Filters update the URL — share any view.
| # | Model | Params | Context | Commercial use | 30d | Min VRAM |
|---|---|---|---|---|---|---|
| 101 | Qwen3-14B | 14.8 B | 41 K | ✓ apache-2.0 | 2.8 M | from 35.2 GB |
| 102 | Qwen3-VL-32B-Instruct | 33.4 B | — | ✓ apache-2.0 | 2.8 M | from 78.9 GB |
| 103 | Ornith-1.0-35B | 0 M | — | ✓ mit | 2.8 M | from 77.7 GB |
| 104 | Ornith-1.0-35B | 0 M | — | ✓ mit | 2.8 M | from 77.7 GB |
| 105 | NVIDIA-Nemotron-3-Super-120B-A12B-NVFP4 | 67.2 B | 262 K | other | 2.8 M | from 98.9 GB |
| 106 | Florence-2-base | 230 M | — | ✓ mit | 2.8 M | from 1.0 GB |
| 107 | resnet50.a1_in1k | 30 M | — | ✓ apache-2.0 | 2.8 M | from 0.6 GB |
| 108 | Gemma-4-31B-IT-NVFP4 | 20.9 B | — | other | 2.8 M | from 39.5 GB |
| 109 | paraphrase-MiniLM-L6-v2 | 20 M | 512 | ✓ apache-2.0 | 2.8 M | from 0.6 GB |
| 110 | DeepSeek-V4-Flash | 158.1 B | 1.0 M | ✓ mit | 2.7 M | from 199.8 GB |
| 111 | voice-activity-detection | — | — | ✓ mit | 2.7 M | — |
| 112 | GLM-5.2-FP8 | 753.4 B | 1.0 M | ✓ mit | 2.7 M | from 944.7 GB |
| 113 | Unlimited-OCR | 3.3 B | 33 K | ✓ mit | 2.7 M | from 8.3 GB |
| 114 | wav2vec2-large-xlsr-53-polish | — | — | ✓ apache-2.0 | 2.7 M | — |
| 115 | wav2vec2-large-xlsr-53-japanese | — | — | ✓ apache-2.0 | 2.7 M | — |
| 116 | Qwen3.5-27B | 27.8 B | — | ✓ apache-2.0 | 2.7 M | from 65.8 GB |
| 117 | Qwen3.5-2B | 2.3 B | — | ✓ apache-2.0 | 2.6 M | from 5.8 GB |
| 118 | distilgpt2 | 90 M | — | ✓ apache-2.0 | 2.6 M | from 0.9 GB |
| 119 | moondream2 | 1.9 B | — | ✓ apache-2.0 | 2.6 M | from 5.0 GB |
| 120 | twitter-roberta-base-sentiment-latest | — | 512 | ✓ cc-by-4.0 | 2.6 M | — |
| 121 | Qwen3.6-27B-AWQ-INT4 | 29.3 B | — | ✓ apache-2.0 | 2.6 M | from 27.4 GB |
| 122 | paraphrase-MiniLM-L3-v2 | 20 M | 512 | ✓ apache-2.0 | 2.6 M | from 0.6 GB |
| 123 | Bonsai-27B-gguf | — | — | ✓ apache-2.0 | 2.6 M | from 1.2 GB |
| 124 | Qwen2.5-0.5B | 490 M | 33 K | ✓ apache-2.0 | 2.6 M | from 1.7 GB |
| 125 | Qwen3.5-35B-A3B | 36.0 B | — | ✓ apache-2.0 | 2.6 M | from 85.0 GB |
| 126 | e5-large-v2 | 340 M | 512 | ✓ mit | 2.6 M | from 2.0 GB |
| 127 | TinyLlama-1.1B-Chat-v1.0 | 1.1 B | 2 K | ✓ apache-2.0 | 2.5 M | from 3.1 GB |
| 128 | snowflake-arctic-embed-xs | 20 M | 512 | unknown | 2.5 M | from 0.6 GB |
| 129 | Qwen2.5-14B-Instruct-AWQ | 14.8 B | 33 K | ✓ apache-2.0 | 2.5 M | from 13.7 GB |
| 130 | chatterbox | — | — | ✓ mit | 2.5 M | from 12.2 GB |
| 131 | mms-300m-1130-forced-aligner | 320 M | — | ✗ cc-by-nc-4.0 | 2.5 M | from 1.9 GB |
| 132 | pythia-160m | 210 M | 2 K | ✓ apache-2.0 | 2.5 M | from 0.9 GB |
| 133 | bge-reranker-large | 560 M | 512 | ✓ mit | 2.4 M | from 3.0 GB |
| 134 | Qwen3-14B-AWQ | 14.8 B | 41 K | ✓ apache-2.0 | 2.4 M | from 13.7 GB |
| 135 | Ornith-1.0-9B | 0 M | — | ✓ mit | 2.4 M | from 21.2 GB |
| 136 | Ornith-1.0-9B | 0 M | — | ✓ mit | 2.4 M | from 21.2 GB |
| 137 | Qwen3-VL-Embedding-8B | 8.1 B | — | ✓ apache-2.0 | 2.4 M | from 19.6 GB |
| 138 | DeepSeek-OCR | 3.3 B | 8 K | ✓ mit | 2.3 M | from 8.3 GB |
| 139 | all-distilroberta-v1 | 80 M | 512 | ✓ apache-2.0 | 2.3 M | from 0.9 GB |
| 140 | Qwen3-TTS-12Hz-1.7B-CustomVoice | 1.9 B | — | ✓ apache-2.0 | 2.3 M | from 5.8 GB |
| 141 | gemma-4-31B-it-qat-w4a16-ct | 33.6 B | — | ✓ apache-2.0 | 2.3 M | from 31.1 GB |
| 142 | multilingual-e5-large-instruct | 560 M | 512 | ✓ mit | 2.3 M | from 1.8 GB |
| 143 | whisper-small | 240 M | — | ✓ apache-2.0 | 2.3 M | from 1.6 GB |
| 144 | Voxtral-Mini-4B-Realtime-2602 | 4.4 B | — | ✓ apache-2.0 | 2.3 M | from 20.7 GB |
| 145 | Qwen3.5-122B-A10B | 125.1 B | — | ✓ apache-2.0 | 2.2 M | from 294.5 GB |
| 146 | GLM-5.2 | 753.3 B | 1.0 M | ✓ mit | 2.2 M | from 1,770.8 GB |
| 147 | Qwen3-VL-2B-Instruct | 2.1 B | — | ✓ apache-2.0 | 2.2 M | from 5.5 GB |
| 148 | bge-base-en-v1.5 | — | 512 | ✓ mit | 2.2 M | — |
| 149 | Qwen3-Coder-Next-FP8 | 79.7 B | 262 K | ✓ apache-2.0 | 2.2 M | from 100.9 GB |
| 150 | Qwen-72B | 72.3 B | 33 K | other | 2.2 M | from 170.4 GB |
VRAM figures are estimates for the smallest available quantization at 8K context — see /methodology. Downloads refresh nightly from the Hugging Face API.