1,060 models · refreshed nightly
All models
Every model in the catalog with its licence, estimated VRAM and daily-tracked downloads. Filters update the URL — share any view.
| # | Model | Params | Context | Commercial use | 30d | Min VRAM |
|---|---|---|---|---|---|---|
| 851 | Qwen3-32B-NVFP4 | 32.0 B | 41 K | ✓ apache-2.0 | 219 K | from 28.0 GB |
| 852 | Llama-3.2-3B-Instruct-GGUF | — | 131 K | ⚠ llama3.2 | 218 K | from 2.0 GB |
| 853 | hubert-large-speech-emotion-recognition-russian-dusha-finetuned | 320 M | — | ✓ apache-2.0 | 218 K | from 1.9 GB |
| 854 | Llama-3.1-Nemotron-Nano-8B-v1 | 8.0 B | 131 K | other | 218 K | from 19.4 GB |
| 855 | GLM-4.7-Flash-GGUF | — | — | ✓ mit | 216 K | from 13.0 GB |
| 856 | Qwen3-14B-GGUF | — | — | ✓ apache-2.0 | 216 K | from 10.4 GB |
| 857 | Gemma-4-E4B-DECKARD-HERETIC-NVFP4 | 6.2 B | — | ⚠ gemma | 216 K | from 12.6 GB |
| 858 | TinyLLama-v0 | <0.1 M | 2 K | ✓ apache-2.0 | 215 K | from 0.5 GB |
| 859 | Qwen2-7B | 7.6 B | 131 K | ✓ apache-2.0 | 214 K | from 18.4 GB |
| 860 | NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16 | 560.5 B | 262 K | other | 213 K | from 1,317.7 GB |
| 861 | GLM-4.7-Flash-MLX-8bit | 29.9 B | 203 K | ✓ mit | 212 K | from 40.0 GB |
| 862 | Kimi-K2.5-NVFP4 | — | — | other | 211 K | from 650.4 GB |
| 863 | xlnet-base-cased | — | — | ✓ mit | 211 K | — |
| 864 | Ornith-1.0-35B-AEON-Ultimate-Uncensored-BF16 | 35.1 B | — | ✓ mit | 211 K | from 83.0 GB |
| 865 | Llama-2-7b-hf | 6.7 B | 4 K | unknown | 210 K | from 16.3 GB |
| 866 | CAJAL-4B | — | — | ✓ apache-2.0 | 209 K | from 3.5 GB |
| 867 | wildguard | 7.3 B | — | ✓ apache-2.0 | 209 K | from 17.5 GB |
| 868 | Qwen3.6-27B-NVFP4 | 18.2 B | — | ✓ apache-2.0 | 209 K | from 27.3 GB |
| 869 | Qwen3-30B-A3B-GPTQ-Int4 | 30.5 B | 41 K | ✓ apache-2.0 | 208 K | from 23.7 GB |
| 870 | DeepSeek-R1-Distill-Llama-70B-GGUF | — | 131 K | ⚠ llama3.3 | 208 K | from 29.5 GB |
| 871 | Bielik-11B-v3.0-Instruct-awq | 11.3 B | 33 K | ✓ apache-2.0 | 208 K | from 9.0 GB |
| 872 | Qwen2.5-Math-1.5B | 1.5 B | 4 K | ✓ apache-2.0 | 208 K | from 4.1 GB |
| 873 | Qwen3.6-35B-A3B-DFlash | 390 M | 262 K | ✓ apache-2.0 | 208 K | from 1.4 GB |
| 874 | Mistral-7B-Instruct-v0.3-AWQ | 7.3 B | 33 K | ✓ apache-2.0 | 208 K | from 6.2 GB |
| 875 | granite-4.1-8b | 8.8 B | 131 K | ✓ apache-2.0 | 207 K | from 21.2 GB |
| 876 | Qwen3Guard-Gen-4B | 4.4 B | 33 K | ✓ apache-2.0 | 207 K | from 10.9 GB |
| 877 | Qwen2.5-0.5B-Instruct-GGUF | — | — | ✓ apache-2.0 | 206 K | from 1.0 GB |
| 878 | Laguna-XS-2.1-NVFP4 | 33.4 B | 262 K | openmdw-1.1 | 206 K | from 29.3 GB |
| 879 | Qwen2.5-Coder-7B-Instruct | 7.6 B | 33 K | ✓ apache-2.0 | 206 K | from 18.4 GB |
| 880 | DialoGPT-medium | — | — | ✓ mit | 204 K | — |
| 881 | DeepSeek-R1-Distill-Llama-8B | 8.0 B | 131 K | ✓ mit | 203 K | from 19.4 GB |
| 882 | Qwen3-32B-FP8 | 32.8 B | 41 K | ✓ apache-2.0 | 202 K | from 43.2 GB |
| 883 | DreamShaper | — | — | other | 202 K | from 185.3 GB |
| 884 | lucid-v1-nemo | 12.2 B | 131 K | other | 200 K | from 29.3 GB |
| 885 | Qwen_Qwen3-Next-80B-A3B-Thinking-GGUF | — | — | ✓ apache-2.0 | 200 K | from 18.7 GB |
| 886 | Qwen3.5-35B-A3B-APEX-GGUF | — | — | ✓ apache-2.0 | 200 K | from 28.4 GB |
| 887 | Qwen3-4B-Instruct-2507-GGUF | — | — | unknown | 200 K | from 2.3 GB |
| 888 | Qwen3.8-27B-MTP-NVFP4 | 27.4 B | — | ✓ apache-2.0 | 200 K | from 27.2 GB |
| 889 | FLUX.1-schnell-gguf | — | — | ✓ apache-2.0 | 200 K | from 4.9 GB |
| 890 | kimi-linear-tiny-random | 5.7 M | — | unknown | 199 K | from 0.5 GB |
| 891 | Phi-3-mini-128k-instruct | 3.8 B | 131 K | ✓ mit | 199 K | from 9.5 GB |
| 892 | Qwen3-30B-A3B-FP8 | 30.5 B | 41 K | ✓ apache-2.0 | 199 K | from 40.8 GB |
| 893 | indictrans2-en-indic-dist-200M | 270 M | — | ✓ mit | 198 K | from 1.7 GB |
| 894 | Qwen3-235B-A22B-Instruct-2507 | 235.1 B | 262 K | ✓ apache-2.0 | 197 K | from 553.0 GB |
| 895 | Ornith-1.5-35B-A3B-MLX-8bit | 34.7 B | — | unknown | 197 K | from 46.2 GB |
| 896 | opus-mt-en-fr | — | 512 | ✓ apache-2.0 | 197 K | — |
| 897 | gemma-4-12b-heretic-abliterated-GGUF | — | — | ✓ apache-2.0 | 196 K | from 0.7 GB |
| 898 | revanimated | — | — | ⚠ creativeml-openrail-m | 191 K | — |
| 899 | IP-Adapter-FaceID | — | — | unknown | 187 K | from 1.5 GB |
| 900 | edgenext_small.usi_in1k | 10 M | — | ✓ mit | 185 K | from 0.5 GB |
VRAM figures are estimates for the smallest available quantization at 8K context — see /methodology. Downloads refresh nightly from the Hugging Face API.