1,023 models · refreshed nightly
All models
Every model in the catalog with its licence, estimated VRAM and daily-tracked downloads. Filters update the URL — share any view.
| # | Model | Params | Context | Commercial use | 30d | Min VRAM |
|---|---|---|---|---|---|---|
| 801 | pythia-160m-deduped | 210 M | 2 K | ✓ apache-2.0 | 191 K | from 0.9 GB |
| 802 | DialoGPT-medium | — | — | ✓ mit | 190 K | — |
| 803 | Qwen2.5-Coder-7B-Instruct-GGUF | — | — | ✓ apache-2.0 | 189 K | from 3.8 GB |
| 804 | Llama-3.2-3B-Instruct | 3.2 B | 131 K | ⚠ llama3.2 | 188 K | from 8.0 GB |
| 805 | gemma4-e4b-claims-comparison | 7.9 B | — | ⚠ gemma | 188 K | from 19.2 GB |
| 806 | Phi-mini-MoE-instruct | 7.7 B | 4 K | ✓ mit | 186 K | from 18.5 GB |
| 807 | Qwen3-0.6B-GGUF | — | — | unknown | 186 K | from 0.9 GB |
| 808 | Laguna-S-2.1-INT4 | 117.6 B | 1.0 M | openmdw-1.1 | 185 K | from 127.8 GB |
| 809 | Sugoi-14B-Ultra-GGUF | — | — | ✓ apache-2.0 | 185 K | from 6.8 GB |
| 810 | Laguna-S-2.1-GGUF | — | — | openmdw-1.1 | 185 K | from 37.6 GB |
| 811 | llava-onevision-qwen2-7b-ov | 8.0 B | 33 K | ✓ apache-2.0 | 185 K | from 19.4 GB |
| 812 | nllb-200-distilled-1.3B | — | 1 K | ✗ cc-by-nc-4.0 | 185 K | — |
| 813 | Qwen2.5-3B-Instruct-GGUF | — | — | other | 185 K | from 2.0 GB |
| 814 | Qwen3-235B-A22B-GGUF | — | 41 K | ✓ apache-2.0 | 184 K | from 55.2 GB |
| 815 | Qwen3-14B-GGUF | — | — | unknown | 184 K | from 6.8 GB |
| 816 | Qwen3-8B | 8.2 B | 41 K | ✓ apache-2.0 | 183 K | from 19.7 GB |
| 817 | openai-gpt | 120 M | — | ✓ mit | 183 K | from 1.0 GB |
| 818 | novaAnimeXL_ilV140 | 2.6 B | — | unknown | 183 K | from 16.1 GB |
| 819 | Qwen3-4B-unsloth-bnb-4bit | 4.1 B | 41 K | ✓ apache-2.0 | 183 K | from 5.0 GB |
| 820 | pegasus-xsum | — | 512 | unknown | 181 K | — |
| 821 | Kimi-K2-Instruct | 1,026.5 B | 131 K | other | 181 K | from 1,286.6 GB |
| 822 | Qwen3-14B-unsloth-bnb-4bit | 15.2 B | 41 K | ✓ apache-2.0 | 181 K | from 15.0 GB |
| 823 | Kimi-K2.5 | 1,026.4 B | — | other | 180 K | from 877.8 GB |
| 824 | Qwen2.5-7B-Instruct-GGUF | — | — | ✓ apache-2.0 | 180 K | from 3.6 GB |
| 825 | GLM-5-NVFP4 | 435.2 B | 203 K | ✓ mit | 180 K | from 594.6 GB |
| 826 | Qwen3-8B-GGUF | — | — | unknown | 180 K | from 4.1 GB |
| 827 | Llama-3_3-Nemotron-Super-49B-v1 | 49.9 B | 131 K | other | 179 K | from 117.7 GB |
| 828 | LLaMmlein_1B_prerelease | 1.1 B | 2 K | other | 179 K | from 5.5 GB |
| 829 | Pony_Diffusion_V6_XL | — | — | cdla-permissive-2.0 | 179 K | from 8.5 GB |
| 830 | Qwen3-1.7B-GGUF | — | — | unknown | 178 K | from 1.5 GB |
| 831 | Phi-3-mini-4k-instruct-gptq-4bit | 3.8 B | 4 K | unknown | 178 K | from 3.6 GB |
| 832 | opus-mt-ROMANCE-en | — | 512 | ✓ apache-2.0 | 177 K | — |
| 833 | Qwen3-32B-GGUF | — | — | unknown | 177 K | from 14.1 GB |
| 834 | Qwen3-30B-A3B-GGUF | — | — | unknown | 177 K | from 12.9 GB |
| 835 | opus-mt-ru-en | — | 512 | ✓ cc-by-4.0 | 177 K | — |
| 836 | Qwen3-Coder-Next-NVFP4-GB10 | — | 262 K | ✓ apache-2.0 | 176 K | from 50.9 GB |
| 837 | Juggernaut-XL-v9 | — | — | ⚠ creativeml-openrail-m | 176 K | from 15.9 GB |
| 838 | starcoder2-3b | 3.0 B | 16 K | bigcode-openrail-m | 176 K | from 14.3 GB |
| 839 | Qwen3-30B-A3B-Thinking-2507-AWQ-4bit | 5.3 B | 262 K | ✓ apache-2.0 | 173 K | from 21.2 GB |
| 840 | avibe | 7.9 B | 33 K | ✓ apache-2.0 | 173 K | from 19.1 GB |
| 841 | Qwen3-235B-A22B-NVFP4 | 132.8 B | 41 K | ✓ apache-2.0 | 173 K | from 168.0 GB |
| 842 | llama-3-8b-instruct-awq | 8.0 B | 8 K | unknown | 173 K | from 8.0 GB |
| 843 | Qwen2.5-0.5B-Instruct-GGUF | — | — | ✓ apache-2.0 | 172 K | from 1.0 GB |
| 844 | NVIDIA-Nemotron-Nano-9B-v2-FP8 | 8.9 B | 131 K | other | 171 K | from 13.1 GB |
| 845 | Qwen3-30B-A3B-FP8 | 30.5 B | 41 K | ✓ apache-2.0 | 171 K | from 40.8 GB |
| 846 | Nemotron-Mini-4B-Instruct | — | 4 K | other | 170 K | — |
| 847 | granite-4.1-3b-GGUF | — | — | ✓ apache-2.0 | 170 K | from 2.0 GB |
| 848 | Qwen3-14B-GPTQ-Int4 | 14.8 B | 41 K | ✓ apache-2.0 | 170 K | from 13.7 GB |
| 849 | LFM2.5-8B-A1B | 8.5 B | 128 K | other | 170 K | from 20.4 GB |
| 850 | falcon-mamba-7b | 7.3 B | — | other | 170 K | from 17.6 GB |
VRAM figures are estimates for the smallest available quantization at 8K context — see /methodology. Downloads refresh nightly from the Hugging Face API.