Find a local model
Compare sizes and context limits, then open one in the calculator. Every model page links the exact config.json it was read from.
More filters · publisher, context, architecture, published files
Mixture-of-experts models route each token through a few experts, so they read fewer bytes per token than their size suggests but still need the whole file in memory.
327 models from 82 publishers · 327 in the catalogue
Ordered by Hugging Face's 30-day download count, read 2026-10-03: a popularity signal, not a measure of quality. Models without a count come last. File sizes are the weight file at the format shown, not the whole memory a run needs.
Qwen3-0.6B
- Parameters
- 752M
- Context
- 40K
- Q4_K_M file
- 0.48 GB
Qwen3-VL-8B-Instruct
- Parameters
- 8.8B
- Context
- 256K
- Q4_K_M file
- 5.03 GB
gemma-4-26B-A4B-it
- Parameters
- 26B
- Context
- 256K
- Q4_K_M file
- 15.4 GB
Qwen3-8B
- Parameters
- 8.2B
- Context
- 40K
- Q4_K_M file
- 5.03 GB
gemma-4-31B-it
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 19.2 GB
Qwen3.5-9B
- Parameters
- 9.7B
- Context
- 256K
- Q4_K_M file
- 3.80 GB–10.4 GB
Qwen2.5-0.5B-Instruct
- Parameters
- 494M
- Context
- 32K
- Q4_K_M file
- 0.41 GB
Qwen2.5-7B-Instruct
- Parameters
- 7.6B
- Context
- 32K
- Q4_K_M file
- 4.68 GB
Qwen3.5-4B
- Parameters
- 4.7B
- Context
- 256K
- Q4_K_M file
- 1.83 GB–5.37 GB
Qwen3-4B
- Parameters
- 4.0B
- Context
- 40K
- Q4_K_M file
- 2.50 GB
Qwen2.5-1.5B-Instruct
- Parameters
- 1.5B
- Context
- 32K
- Q4_K_M file
- 1.12 GB
Qwen3.8-27B
- Parameters
- 28B
- Context
- 256K
- Q4_K_M file
- 10.9 GB–26.0 GB
gpt-oss-20b
- Parameters
- 21B
- Context
- 128K
- Q4_K_M file
- 12.8 GB
Qwen2.5-VL-7B-Instruct
- Parameters
- 8.3B
- Context
- 125K
- Q4_K_M file
- 3.27 GB–8.16 GB
GLM-5.3-Flash
- Parameters
- 321B
- Context
- 1M
- Q4_K_M file
- 126.5 GB–267.7 GB
Qwen3.5-2B
- Parameters
- 2.3B
- Context
- 256K
- Q4_K_M file
- 0.90 GB–3.10 GB
dolphin-2.9.1-yi-1.5-34b
- Parameters
- 34B
- Context
- 8K
- Q4_K_M file
- 20.7 GB
DeepSeek-V4-Flash-0731
- Parameters
- 304B checkpoint · DSpark attached
- Context
- 1M
- Q4_K_M file
- 119.7 GB–253.1 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
gpt-oss-120b
- Parameters
- 117B
- Context
- 128K
- Q4_K_M file
- 70.8 GB
gemma-4-E4B-it
- Parameters
- 8.0B
- Context
- 128K
- Q4_K_M file
- 3.15 GB–8.22 GB
Qwen2.5-3B-Instruct
- Parameters
- 3.1B
- Context
- 32K
- Q4_K_M file
- 2.10 GB
Qwen3-32B
- Parameters
- 33B
- Context
- 40K
- Q4_K_M file
- 19.8 GB
Qwen3-4B-Instruct-2507
- Parameters
- 4.0B
- Context
- 256K
- Q4_K_M file
- 2.72 GB
DeepSeek-V3.2
- Parameters
- 685B
- Context
- 160K
- Q4_K_M file
- 269.9 GB–570.0 GB
Qwen3-VL-4B-Instruct
- Parameters
- 4.4B
- Context
- 256K
- Q4_K_M file
- 2.72 GB
pythia-160m
- Parameters
- 213M
- Context
- 2K
- Q4_K_M file
- 0.08 GB–0.27 GB
NVIDIA-Nemotron-3-Nano-4B-BF16
- Parameters
- 4.0B
- Context
- 256K
- Q4_K_M file
- 1.56 GB–4.27 GB
Qwen3.6-35B-A3B
- Parameters
- 36B
- Context
- 256K
- Q4_K_M file
- 14.2 GB–31.0 GB
Qwen3-1.7B
- Parameters
- 2.0B
- Context
- 40K
- Q4_K_M file
- 1.28 GB
gemma-4-E2B-it
- Parameters
- 5.1B
- Context
- 128K
- Q4_K_M file
- 2.02 GB–5.21 GB
OTel-2.0-LLM-31B-IT
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 19.2 GB
Qwen3-VL-2B-Instruct
- Parameters
- 2.1B
- Context
- 256K
- Q4_K_M file
- 0.84 GB–2.50 GB
Qwen3-14B
- Parameters
- 15B
- Context
- 40K
- Q4_K_M file
- 9.00 GB
Qwen3.5-0.8B
- Parameters
- 873M
- Context
- 256K
- Q4_K_M file
- 0.34 GB–1.33 GB
JiRackUltra_1b
- Parameters
- 1.8B
- Context
- 128K
- Q4_K_M file
- 1.12 GB
Qwen3.6-27B
- Parameters
- 28B
- Context
- 256K
- Q4_K_M file
- 10.9 GB–26.0 GB
Qwen2.5-VL-3B-Instruct
- Parameters
- 3.8B
- Context
- 125K
- Q4_K_M file
- 1.48 GB–3.85 GB
Qwen2.5-Coder-7B-Instruct
- Parameters
- 7.6B
- Context
- 32K
- Q4_K_M file
- 4.68 GB
Mistral-7B-Instruct-v0.3
- Parameters
- 7.2B
- Context
- 32K
- Q4_K_M file
- 4.37 GB
Qwen2.5-32B-Instruct
- Parameters
- 33B
- Context
- 32K
- Q4_K_M file
- 19.9 GB
gemma-4-12B-it
- Parameters
- 12B
- Context
- 256K
- Q4_K_M file
- 7.87 GB
Qwen3.5-27B
- Parameters
- 28B
- Context
- 256K
- Q4_K_M file
- 10.9 GB–26.0 GB
SmolLM2-135M-Instruct
- Parameters
- 135M
- Context
- 8K
- Q4_K_M file
- 0.10 GB
SmolLM2-135M
- Parameters
- 135M
- Context
- 8K
- Q4_K_M file
- 0.10 GB
GLM-4.7-Flash
- Parameters
- 31B
- Context
- 198K
- Q4_K_M file
- 12.3 GB–26.6 GB
Mistral-7B-Instruct-v0.2
- Parameters
- 7.2B
- Context
- 32K
- Q4_K_M file
- 4.37 GB
Qwen2.5-Coder-14B-Instruct
- Parameters
- 15B
- Context
- 32K
- Q4_K_M file
- 8.99 GB
Qwen2.5-14B-Instruct
- Parameters
- 15B
- Context
- 32K
- Q4_K_M file
- 8.99 GB
Qwen3.5-35B-A3B
- Parameters
- 36B
- Context
- 256K
- Q4_K_M file
- 14.2 GB–31.0 GB
Qwen3-30B-A3B
- Parameters
- 31B
- Context
- 40K
- Q4_K_M file
- 18.6 GB
Qwen2.5-0.5B
- Parameters
- 494M
- Context
- 32K
- Q4_K_M file
- 0.41 GB
Ornith-1.0-35B
- Parameters
- unknown
- Context
- 256K
- Q4_K_M file
- 21.2 GB
The published parameter count contradicts the published file sizes, so it is not used.
pythia-70m-deduped
- Parameters
- 95.6M
- Context
- 2K
- Q4_K_M file
- 0.04 GB–0.14 GB
DeepSeek-V3-0324
- Parameters
- 685B
- Context
- 160K
- Q4_K_M file
- 269.5 GB–569.4 GB
Qwen3.8-Flash-Next
- Parameters
- 180B
- Context
- 256K
- Q4_K_M file
- 70.9 GB–150.6 GB
GLM-5.3
- Parameters
- 753B
- Context
- 1M
- Q4_K_M file
- 446.4 GB
TinyLlama-1.1B-Chat-v1.0
- Parameters
- 1.1B
- Context
- 2K
- Q4_K_M file
- 0.67 GB
DeepSeek-V3
- Parameters
- 685B
- Context
- 160K
- Q4_K_M file
- 269.5 GB–569.4 GB
Kimi-K3
- Parameters
- 2.8T total · 104B active parameters
- Context
- 1M
- Q4_K_M file
- 1102.5 GB–2322.7 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
NVIDIA-Nemotron-3-Super-120B-A12B-BF16
- Parameters
- 124B
- Context
- 256K
- Q4_K_M file
- 48.7 GB–103.7 GB
MiniMax-M2.7
- Parameters
- 229B
- Context
- 200K
- Q4_K_M file
- 138.3 GB
DeepSeek-V4-Flash
- Parameters
- 284B total · 13B active parameters
- Context
- 1M
- Q4_K_M file
- 175.0 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
MiniCPM5-2B
- Parameters
- 2.5B
- Context
- 128K
- Q4_K_M file
- 1.56 GB
DeepSeek-R1
- Parameters
- 684B
- Context
- 160K
- Q4_K_M file
- 269.5 GB–569.3 GB
DeepSeek-R1-Distill-Qwen-1.5B
- Parameters
- 1.8B
- Context
- 128K
- Q4_K_M file
- 1.12 GB
Ornith-1.0-9B
- Parameters
- unknown
- Context
- 256K
- Q4_K_M file
- 5.63 GB
The published parameter count contradicts the published file sizes, so it is not used.
DeepSeek-V4-Flash-Vision-Exp
- Parameters
- 305B checkpoint · multimodal DSpark
- Context
- 1M
- Q4_K_M file
- 120.1 GB–254.0 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
DeepSeek-Coder-V2-Lite-Instruct
- Parameters
- 16B
- Context
- 160K
- Q4_K_M file
- 6.18 GB–13.5 GB
Qwen2.5-Coder-32B-Instruct
- Parameters
- 33B
- Context
- 32K
- Q4_K_M file
- 19.9 GB
NVIDIA-Nemotron-3-Nano-30B-A3B-BF16
- Parameters
- 32B
- Context
- 256K
- Q4_K_M file
- 12.4 GB–27.0 GB
Qwen3-30B-A3B-Instruct-2507
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 18.6 GB
Qwen2.5-VL-32B-Instruct
- Parameters
- 33B
- Context
- 125K
- Q4_K_M file
- 13.2 GB–29.6 GB
DeepSeek-V4.1-Flash
- Parameters
- 552B backbone parameters · 196B Engram
- Context
- 1M
- Q4_K_M file
- 448.6 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
Inkling
- Parameters
- 952B
- Context
- unknown
- Q4_K_M file
- 585.6 GB
GLM-5.2
- Parameters
- 753B
- Context
- 1M
- Q4_K_M file
- 446.4 GB
Qwen3-1.7B-Base
- Parameters
- 1.7B
- Context
- 32K
- Q4_K_M file
- 1.28 GB
DeepSeek-R1-0528-Qwen3-8B
- Parameters
- 8.2B
- Context
- 128K
- Q4_K_M file
- 5.03 GB
deepseek-coder-7b-instruct-v1.5
- Parameters
- 6.9B
- Context
- 4K
- Q4_K_M file
- 4.22 GB
Inkling-Small
- Parameters
- 266B
- Context
- unknown
- Q4_K_M file
- 104.7 GB–222.3 GB
OTel-LLM-E4B-IT
- Parameters
- unknown
- Context
- 128K
- Weight file
- no size
Sizeno data648.7K downloads / 30dQwen3-4B-Base
- Parameters
- 4.0B
- Context
- 32K
- Q4_K_M file
- 2.72 GB
SmolLM3-3B
- Parameters
- 3.1B
- Context
- 64K
- Q4_K_M file
- 2.06 GB
phi-2
- Parameters
- 2.8B
- Context
- 2K
- Q4_K_M file
- 1.09 GB–2.62 GB
Qwen3-Coder-Next
- Parameters
- 80B
- Context
- 256K
- Q4_K_M file
- 48.4 GB
pythia-14m
- Parameters
- 14.1M
- Context
- 2K
- Q4_K_M file
- 5.5 MB–0.03 GB
PowerMoE-3b
- Parameters
- 3.4B
- Context
- 4K
- Q4_K_M file
- 2.06 GB
UI-TARS-1.5-7B
- Parameters
- 8.3B
- Context
- 125K
- Q4_K_M file
- 3.27 GB–8.16 GB
Mistral-Small-3.1-24B-Instruct-2503
- Parameters
- 24B
- Context
- 128K
- Q4_K_M file
- 14.3 GB
Qwen2.5-Coder-3B-Instruct
- Parameters
- 3.1B
- Context
- 32K
- Q4_K_M file
- 2.10 GB
NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16
- Parameters
- 32B
- Context
- 256K
- Q4_K_M file
- 12.4 GB–27.0 GB
granite-4.1-3b
- Parameters
- 3.4B
- Context
- 128K
- Q4_K_M file
- 2.24 GB
japanese-gpt-neox-small
- Parameters
- 204M
- Context
- 2K
- Q4_K_M file
- 0.08 GB–0.25 GB
Qwen3.5-122B-A10B
- Parameters
- 125B
- Context
- 256K
- Q4_K_M file
- 49.3 GB–105.5 GB
Qwen3-Coder-30B-A3B-Instruct
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 18.6 GB
Qwen2.5-Coder-1.5B-Instruct
- Parameters
- 1.5B
- Context
- 32K
- Q4_K_M file
- 1.12 GB
OTel-LLM-27B-IT
- Parameters
- unknown
- Context
- 128K
- Weight file
- no size
Sizeno data491.3K downloads / 30dLlama-3.2-1B-Instruct
- Parameters
- 1.2B
- Context
- 128K
- Q4_K_M file
- 0.95 GB
Olmo-3-7B-Instruct
- Parameters
- 7.3B
- Context
- 64K
- Q4_K_M file
- 4.47 GB
Kimi-K2.6
- Parameters
- 1T total · 32B active parameters
- Context
- 256K
- Q4_K_M file
- 393.8 GB–831.3 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
phi-4
- Parameters
- 15B
- Context
- 16K
- Q4_K_M file
- 8.89 GB
gpt-neox-20b
- Parameters
- 21B
- Context
- 2K
- Q4_K_M file
- 8.17 GB–17.9 GB
Apertus-8B-Instruct-2509
- Parameters
- 8.1B
- Context
- 64K
- Q4_K_M file
- 3.17 GB–7.95 GB
Ornith-1.5-9B
- Parameters
- 9.7B
- Context
- 256K
- Q4_K_M file
- 5.78 GB
Qwen3-235B-A22B
- Parameters
- 235B
- Context
- 40K
- Q4_K_M file
- 142.2 GB
MiniMax-M2.5
- Parameters
- 229B
- Context
- 192K
- Q4_K_M file
- 138.3 GB
DeepSeek-R1-Distill-Qwen-32B
- Parameters
- 33B
- Context
- 128K
- Q4_K_M file
- 19.8 GB
MiniCPM5-1B
- Parameters
- 1.1B
- Context
- 128K
- Q4_K_M file
- 0.69 GB
Qwen3-VL-30B-A3B-Instruct
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 18.6 GB
SmolLM2-360M
- Parameters
- 362M
- Context
- 8K
- Q4_K_M file
- 0.26 GB
Mistral-7B-v0.1
- Parameters
- 7.2B
- Context
- 32K
- Q4_K_M file
- 4.37 GB
DeepSeek-V4-Pro
- Parameters
- 1.6T total · 49B active parameters
- Context
- 1M
- Q4_K_M file
- 970.3 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
saiga_llama3_8b
- Parameters
- 8.0B
- Context
- 8K
- Q4_K_M file
- 4.92 GB
OLMo-2-0425-1B
- Parameters
- 1.5B
- Context
- 4K
- Q4_K_M file
- 0.94 GB
Hermes-3-Llama-3.1-8B
- Parameters
- 8.0B
- Context
- 128K
- Q4_K_M file
- 4.92 GB
CodeLlama-7b-hf
- Parameters
- 6.7B
- Context
- 16K
- Q4_K_M file
- 4.08 GB
Qwen3.5-397B-A17B
- Parameters
- 403B
- Context
- 256K
- Q4_K_M file
- 158.8 GB–336.6 GB
falcon-7b
- Parameters
- 7.2B
- Context
- unknown
- Q4_K_M file
- 2.84 GB–6.68 GB
Phi-3.5-mini-instruct
- Parameters
- 3.8B
- Context
- 128K
- Q4_K_M file
- 2.32 GB
GLM-4.5-Air
- Parameters
- 110B
- Context
- 128K
- Q4_K_M file
- 43.5 GB–93.0 GB
Phi-4-mini-instruct
- Parameters
- 3.8B
- Context
- 128K
- Q4_K_M file
- 2.79 GB
GLM-5
- Parameters
- 754B
- Context
- 198K
- Q4_K_M file
- 446.4 GB
NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16
- Parameters
- 561B
- Context
- 256K
- Q4_K_M file
- 220.7 GB–467.0 GB
Ornith-1.5-397B
- Parameters
- 403B
- Context
- 256K
- Q4_K_M file
- 244.3 GB
DeepSeek-V3.1
- Parameters
- 685B
- Context
- 160K
- Q4_K_M file
- 269.5 GB–569.4 GB
Phi-3-mini-4k-instruct
- Parameters
- 3.8B
- Context
- 4K
- Q4_K_M file
- 2.32 GB
Mistral-Nemo-Instruct-2407
- Parameters
- 12B
- Context
- 128K
- Q4_K_M file
- 7.47 GB
DeepSeek-R1-Distill-Qwen-14B
- Parameters
- 15B
- Context
- 128K
- Q4_K_M file
- 8.99 GB
Qwen3-VL-32B-Instruct
- Parameters
- 33B
- Context
- 256K
- Q4_K_M file
- 19.8 GB
NVIDIA-Nemotron-Nano-9B-v2
- Parameters
- 8.9B
- Context
- 128K
- Q4_K_M file
- 3.50 GB–8.76 GB
Qwen3-VL-235B-A22B-Instruct
- Parameters
- 236B
- Context
- 256K
- Q4_K_M file
- 142.2 GB
Kimi-K2.5
- Parameters
- 1T total · 32B active parameters
- Context
- 256K
- Q4_K_M file
- 393.8 GB–831.3 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
EXAONE-3.5-7.8B-Instruct
- Parameters
- 7.8B
- Context
- 32K
- Q4_K_M file
- 4.77 GB
Kimi-K2-Instruct
- Parameters
- 1026B
- Context
- 128K
- Q4_K_M file
- 619.0 GB
TwIL-LM3
- Parameters
- 3.1B
- Context
- 64K
- Q4_K_M file
- 2.06 GB
Hy3
- Parameters
- 299B
- Context
- 256K
- Q4_K_M file
- 177.7 GB
granite-4.1-30b
- Parameters
- 29B
- Context
- 128K
- Q4_K_M file
- 17.5 GB
MiniMax-M2
- Parameters
- 229B
- Context
- 192K
- Q4_K_M file
- 138.3 GB
Qwen2.5-72B-Instruct
- Parameters
- 73B
- Context
- 32K
- Q4_K_M file
- 43.8 GB
Qwen3-Next-80B-A3B-Instruct
- Parameters
- 81B
- Context
- 256K
- Q4_K_M file
- 48.4 GB
llama-7b
- Parameters
- 6.7B
- Context
- 2K
- Q4_K_M file
- 4.08 GB
Muse-Glimmer-30B
- Parameters
- 30B
- Context
- 128K
- Q4_K_M file
- 11.7 GB–27.9 GB
Agents-A1-4B
- Parameters
- 4.5B
- Context
- 256K
- Q4_K_M file
- 1.79 GB–5.27 GB
SmolLM2-360M-Instruct
- Parameters
- 362M
- Context
- 8K
- Q4_K_M file
- 0.26 GB
Ornith-1.5-35B-A3B
- Parameters
- 36B
- Context
- 256K
- Q4_K_M file
- 21.7 GB
GLM-5.1
- Parameters
- 754B
- Context
- 198K
- Q4_K_M file
- 446.4 GB
DeepSeek-R1-Distill-Qwen-7B
- Parameters
- 7.6B
- Context
- 128K
- Q4_K_M file
- 4.68 GB
GigaChat3.1-Audio-10B-A1.8B
- Parameters
- unknown
- Context
- 256K
- Weight file
- no size
Sizeno data261.8K downloads / 30dpythia-410m
- Parameters
- 506M
- Context
- 2K
- Q4_K_M file
- 0.32 GB
Mistral-Small-3.2-24B-Instruct-2506
- Parameters
- 24B
- Context
- 128K
- Q4_K_M file
- 14.3 GB
Ministral-3-14B-Instruct-2512
- Parameters
- 14B
- Context
- 256K
- Q4_K_M file
- 8.24 GB
Meta-Llama-3.1-8B-Instruct
- Parameters
- 8.0B
- Context
- 128K
- Q4_K_M file
- 4.92 GB
MiMo-V2.5
- Parameters
- 311B
- Context
- 1M
- Q4_K_M file
- 191.2 GB
Zamba2-1.2B-instruct
- Parameters
- 1.2B
- Context
- 4K
- Q4_K_M file
- 0.48 GB–1.16 GB
DeepSeek-V2-Lite
- Parameters
- 16B
- Context
- 160K
- Q4_K_M file
- 6.18 GB–13.5 GB
LLaDA2.0-mini
- Parameters
- 16B
- Context
- 32K
- Q4_K_M file
- 9.86 GB
sarvam-30b
- Parameters
- 32B
- Context
- 128K
- Q4_K_M file
- 19.5 GB
Mixtral-8x7B-Instruct-v0.1
- Parameters
- 47B
- Context
- 32K
- Q4_K_M file
- 28.3 GB
SmolLM2-1.7B-Instruct
- Parameters
- 1.7B
- Context
- 8K
- Q4_K_M file
- 1.11 GB
Llama-3.2-3B-Instruct
- Parameters
- 3.2B
- Context
- 128K
- Q4_K_M file
- 2.24 GB
Kimi-Linear-48B-A3B-Instruct
- Parameters
- 49B
- Context
- unknown
- Q4_K_M file
- 29.5 GB
DeepSeek-R1-Distill-Llama-8B
- Parameters
- 8.0B
- Context
- 128K
- Q4_K_M file
- 4.92 GB
Qwen3-235B-A22B-Instruct-2507
- Parameters
- 235B
- Context
- 256K
- Q4_K_M file
- 142.2 GB
Step-3.5-Flash
- Parameters
- 199B
- Context
- 256K
- Q4_K_M file
- 78.5 GB–166.5 GB
Llama-2-7b-hf
- Parameters
- 6.7B
- Context
- 4K
- Q4_K_M file
- 4.08 GB
deepseek-coder-6.7b-instruct
- Parameters
- 6.7B
- Context
- 16K
- Q4_K_M file
- 4.08 GB
Ornith-1.0-397B
- Parameters
- 397B
- Context
- 256K
- Q4_K_M file
- 238.8 GB
Laguna-XS-2.1
- Parameters
- 33B
- Context
- 256K
- Q4_K_M file
- 20.3 GB
VLM2Vec-Full
- Parameters
- 4.1B
- Context
- 128K
- Q4_K_M file
- 1.63 GB–3.67 GB
North-Micro-Vision-Instruct
- Parameters
- 2.5B
- Context
- 488K
- Q4_K_M file
- 1.60 GB
granite-4.1-8b
- Parameters
- 8.8B
- Context
- 128K
- Q4_K_M file
- 5.35 GB
MiniMax-M3
- Parameters
- 427B
- Context
- 1M
- Q4_K_M file
- 168.1 GB–356.7 GB
DeepSeek-R1-0528
- Parameters
- 685B
- Context
- 160K
- Q4_K_M file
- 269.5 GB–569.4 GB
Laguna-S-2.1
- Parameters
- 118B
- Context
- 1M
- Q4_K_M file
- 96.0 GB
Phi-3-mini-128k-instruct
- Parameters
- 3.8B
- Context
- 128K
- Q4_K_M file
- 2.32 GB
OLMoE-1B-7B-0125-Instruct
- Parameters
- 6.9B
- Context
- 4K
- Q4_K_M file
- 4.21 GB
Qwen3-VL-8B-Thinking
- Parameters
- 8.8B
- Context
- 256K
- Q4_K_M file
- 5.03 GB
DeepSeek-V2-Lite-Chat
- Parameters
- 16B
- Context
- 160K
- Q4_K_M file
- 6.18 GB–13.5 GB
pythia-160m-deduped
- Parameters
- 213M
- Context
- 2K
- Q4_K_M file
- 0.08 GB–0.27 GB
SmolLM3-3B-Base
- Parameters
- 3.1B
- Context
- 64K
- Q4_K_M file
- 2.06 GB
granite-4.2-8b
- Parameters
- 8.8B
- Context
- 128K
- Q4_K_M file
- 5.35 GB
Supra2-100M-Instruct
- Parameters
- 101M
- Context
- 2K
- Q4_K_M file
- 0.08 GB
Ministral-3-8B-Instruct-2512
- Parameters
- 8.9B
- Context
- 256K
- Q4_K_M file
- 5.20 GB
LFM2.5-1.2B-Instruct
- Parameters
- 1.2B
- Context
- 125K
- Q4_K_M file
- 0.73 GB
GLM-4.5
- Parameters
- 358B
- Context
- 128K
- Q4_K_M file
- 141.1 GB–298.7 GB
Ministral-3-3B-Instruct-2512
- Parameters
- 3.8B
- Context
- 256K
- Q4_K_M file
- 2.15 GB
Kimi-K2.7-Code
- Parameters
- 1T total · 32B active parameters
- Context
- 256K
- Q4_K_M file
- 393.8 GB–831.3 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
tiny-mixtral
- Parameters
- 247M
- Context
- 128K
- Q4_K_M file
- 0.16 GB
LFM2.5-2.6B
- Parameters
- 2.7B
- Context
- 128K
- Q4_K_M file
- 1.67 GB
Hy3-preview
- Parameters
- 299B
- Context
- 256K
- Q4_K_M file
- 177.7 GB
GLM-4.6V-Flash
- Parameters
- 10B
- Context
- 128K
- Q4_K_M file
- 4.05 GB–10.0 GB
MiMo-V2-Flash
- Parameters
- 310B
- Context
- 256K
- Q4_K_M file
- 191.2 GB
GLM-4.7
- Parameters
- 358B
- Context
- 198K
- Q4_K_M file
- 141.1 GB–298.7 GB
gemma-3-4b-it
- Parameters
- 4.3B
- Context
- 128K
- Q4_K_M file
- 1.69 GB–5.16 GB
DeepSeek-V4-Pro-0813
- Parameters
- 1.6T-class backbone · DSpark attached
- Context
- 1M
- Q4_K_M file
- 970.3 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
LFM2.5-230M
- Parameters
- 230M
- Context
- 125K
- Q4_K_M file
- 0.15 GB
MiMo-V2.6-Pro-RL
- Parameters
- 1.02T total · 42B active parameters
- Context
- 1M
- Q4_K_M file
- 627.8 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
Qwen3-30B-A3B-Thinking-2507
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 18.6 GB
Edge0-35B-A3B-preview
- Parameters
- 35B-class sparse MoE · 256 experts · 4 active
- Context
- 256K
- Q4_K_M file
- 13.8 GB–30.2 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
Nanbeige4.2-3B
- Parameters
- 4.2B
- Context
- 256K
- Q4_K_M file
- 2.58 GB
Qwen2.5-VL-72B-Instruct
- Parameters
- 73B
- Context
- 125K
- Q4_K_M file
- 43.8 GB
Phi-tiny-MoE-instruct
- Parameters
- 3.8B
- Context
- 4K
- Q4_K_M file
- 2.29 GB
LFM2.5-350M
- Parameters
- 354M
- Context
- 125K
- Q4_K_M file
- 0.23 GB
DeepSeek-R1-Distill-Llama-70B
- Parameters
- 71B
- Context
- 128K
- Q4_K_M file
- 42.5 GB
Hunyuan-A13B-Instruct
- Parameters
- 80B
- Context
- 32K
- Q4_K_M file
- 48.8 GB
Kimi-K2-Instruct-0905
- Parameters
- 1026B
- Context
- 256K
- Q4_K_M file
- 619.0 GB
SmolLM2-1.7B
- Parameters
- 1.7B
- Context
- 8K
- Q4_K_M file
- 1.11 GB
Kimi-K2-Thinking
- Parameters
- 1T total · 32B active parameters
- Context
- 256K
- Q4_K_M file
- 393.8 GB–831.3 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
gemma-3-1b-it
- Parameters
- 1000M
- Context
- 32K
- Q4_K_M file
- 0.85 GB
OLMo-2-0325-32B-Instruct
- Parameters
- 32B
- Context
- 4K
- Q4_K_M file
- 19.5 GB
Mistral-Small-24B-Instruct-2501
- Parameters
- 24B
- Context
- 32K
- Q4_K_M file
- 14.3 GB
Mistral-Small-4-119B-2603
- Parameters
- 119B
- Context
- 256K
- Q4_K_M file
- 71.6 GB
DeepSeek-V3.2-Exp
- Parameters
- 685B
- Context
- 160K
- Q4_K_M file
- 269.9 GB–570.1 GB
granite-4.2-3b
- Parameters
- 3.7B
- Context
- 128K
- Q4_K_M file
- 2.24 GB
Xing4.0-29B-A4B
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 12.3 GB–27.0 GB
MiMo-V2.6-Flash-RL
- Parameters
- 309B total · 15B active parameters
- Context
- 1M
- Q4_K_M file
- 191.2 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
Llama-3.3-70B-Instruct
- Parameters
- 71B
- Context
- 128K
- Q4_K_M file
- 42.5 GB
Qwen3-Next-80B-A3B-Thinking
- Parameters
- 81B
- Context
- 256K
- Q4_K_M file
- 48.4 GB
GLM-4.5V
- Parameters
- 108B
- Context
- 64K
- Q4_K_M file
- 63.9 GB
gemma-3-27b-it
- Parameters
- 27B
- Context
- 128K
- Q4_K_M file
- 17.3 GB
Mixtral-8x22B-Instruct-v0.1
- Parameters
- 141B
- Context
- 64K
- Q4_K_M file
- 85.0 GB
K2-Horizon-0.9B
- Parameters
- 1.1B
- Context
- 128K
- Q4_K_M file
- 0.67 GB
Spark-X2.5-4B
- Parameters
- 4.1B
- Context
- 1M
- Q4_K_M file
- 2.73 GB
qwen3.5-4B-super-coder
- Parameters
- unknown
- Context
- 256K
- Weight file
- no size
Sizeno data37K downloads / 30dgpt-oss-safeguard-20b
- Parameters
- 21B total · 3.6B active parameters
- Context
- 128K
- Q4_K_M file
- 12.8 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
Qwen3-Coder-480B-A35B-Instruct
- Parameters
- 480B
- Context
- 256K
- Q4_K_M file
- 290.1 GB
granite-4.2-30b
- Parameters
- 29B
- Context
- 128K
- Q4_K_M file
- 17.7 GB
Qwen3.8-2.4T-A95B
- Parameters
- 2446B
- Context
- 256K
- Q4_K_M file
- 1457.5 GB
gemma-2-2b-it
- Parameters
- 2.6B
- Context
- 8K
- Q4_K_M file
- 2.04 GB
Nex-N2.5-Pro
- Parameters
- 397B
- Context
- 256K
- Q4_K_M file
- 238.8 GB
LFM2.5-8B-A1B
- Parameters
- 8.5B
- Context
- 125K
- Q4_K_M file
- 5.16 GB
Qwen3.8-27B-MTPLX-Optimized-Speed
- Parameters
- 27B-class · 4-bit dynamic quantization
- Context
- 256K
- Q4_K_M file
- 10.6 GB–25.4 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
NeoHorse-1-4B
- Parameters
- 4.2B
- Context
- 256K
- Q4_K_M file
- 1.66 GB–5.00 GB
Hy-MT2-1.8B
- Parameters
- 2.0B
- Context
- 256K
- Q4_K_M file
- 1.13 GB
K2-Horizon-7B
- Parameters
- 9.0B
- Context
- 512K
- Q4_K_M file
- 5.59 GB
EXAONE-4.0-32B
- Parameters
- 32B
- Context
- 128K
- Q4_K_M file
- 19.3 GB
LFM2.5-VL-3B
- Parameters
- 3.1B
- Context
- 32K
- Q4_K_M file
- 1.23 GB–3.21 GB
Hy4-preview
- Parameters
- 780B
- Context
- 1M
- Q4_K_M file
- 464.5 GB
Step-3.7-Flash
- Parameters
- 201B
- Context
- 256K
- Q4_K_M file
- 79.3 GB–168.1 GB
Voxtral-Small-24B-2507
- Parameters
- 24B
- Context
- 32K
- Q4_K_M file
- 9.55 GB–21.7 GB
sarvam-105b
- Parameters
- 106B
- Context
- 128K
- Q4_K_M file
- 63.8 GB
EXAONE-4.0-1.2B
- Parameters
- 1.3B
- Context
- 64K
- Q4_K_M file
- 0.93 GB
DeepSeek-V3.1-Terminus
- Parameters
- 685B
- Context
- 160K
- Q4_K_M file
- 269.5 GB–569.4 GB
Devstral-Small-2507
- Parameters
- 24B
- Context
- 128K
- Q4_K_M file
- 14.3 GB
MiMo-V2.5-Pro
- Parameters
- 1023B
- Context
- 1M
- Q4_K_M file
- 627.8 GB
Apertus-70B-Instruct-2509
- Parameters
- 71B
- Context
- 64K
- Q4_K_M file
- 27.8 GB–61.0 GB
K2-Horizon-3.7B
- Parameters
- 5.1B
- Context
- 512K
- Q4_K_M file
- 3.16 GB
HRM-Text-1B
- Parameters
- 1.2B
- Context
- 4K
- Q4_K_M file
- 0.47 GB–1.22 GB
ERNIE-4.5-21B-A3B-PT
- Parameters
- 22B
- Context
- 128K
- Q4_K_M file
- 8.64 GB–18.8 GB
Qwen3-235B-A22B-Thinking-2507
- Parameters
- 235B
- Context
- 256K
- Q4_K_M file
- 142.2 GB
Ling-3.0-tiny
- Parameters
- 7.9B
- Context
- 128K
- Q4_K_M file
- 4.82 GB
Qwen3-VL-30B-A3B-Thinking
- Parameters
- 31B
- Context
- 256K
- Q4_K_M file
- 18.6 GB
GLM-4.6
- Parameters
- 357B
- Context
- 198K
- Q4_K_M file
- 211.8 GB
gemma-3-12b-it
- Parameters
- 12B
- Context
- 128K
- Q4_K_M file
- 4.80 GB–12.5 GB
needle2
- Parameters
- unknown
- Context
- 2K
- Weight file
- no size
Sizeno data16.8K downloads / 30dK2-Horizon-375B-A23B
- Parameters
- 379B
- Context
- 512K
- Q4_K_M file
- 227.7 GB
Ling-3.0-flash
- Parameters
- 127B
- Context
- 256K
- Q4_K_M file
- 77.0 GB
Hy-MT2-7B
- Parameters
- 8.0B
- Context
- 256K
- Q4_K_M file
- 4.62 GB
NeoHorse-1-9B
- Parameters
- 9.0B
- Context
- 256K
- Q4_K_M file
- 3.53 GB–9.83 GB
MiMo-V2.6-Distill-Qwen-9B
- Parameters
- 9.4B
- Context
- 256K
- Q4_K_M file
- 3.71 GB–10.2 GB
Nemotron-3.5-Content-Safety
- Parameters
- 4.3B
- Context
- 128K
- Q4_K_M file
- 1.69 GB–5.16 GB
MiniMax-M2.1
- Parameters
- 229B
- Context
- 192K
- Q4_K_M file
- 138.3 GB
Fanar-1-9B-Instruct
- Parameters
- 8.8B
- Context
- 4K
- Q4_K_M file
- 5.64 GB
gemma-2-9b-it
- Parameters
- 9.2B
- Context
- 8K
- Q4_K_M file
- 6.28 GB
Qwen3.8-9B-Distill
- Parameters
- 9.7B
- Context
- 256K
- Q4_K_M file
- 5.78 GB
Llama-3.1-Nemotron-Nano-8B-v1
- Parameters
- 8.0B
- Context
- 128K
- Q4_K_M file
- 4.92 GB
Hy-MT2-30B-A3B
- Parameters
- 30B
- Context
- 256K
- Q4_K_M file
- 18.2 GB
Nex-N2.5-mini
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 13.8 GB–30.3 GB
KAT-Coder-V2.5-Dev
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 20.8 GB
Hemmingway-1
- Parameters
- 27B
- Context
- 256K
- Q4_K_M file
- 10.6 GB–25.3 GB
Agents-A1
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 13.8 GB–30.3 GB
Qwen3.8-4B-Distill
- Parameters
- 4.7B
- Context
- 256K
- Q4_K_M file
- 2.78 GB
North-Mini-Code-1.0
- Parameters
- 30B
- Context
- 488K
- Q4_K_M file
- 18.9 GB
Qwen-AgentWorld-35B-A3B
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 20.8 GB
Spark-X2.5-1.7B
- Parameters
- 1.7B
- Context
- 1M
- Q4_K_M file
- 1.24 GB
Devstral-2-123B-Instruct-2512
- Parameters
- 125B
- Context
- 256K
- Q4_K_M file
- 74.9 GB
Dolphin-Mistral-24B-Venice-Edition
- Parameters
- 24B
- Context
- 128K
- Q4_K_M file
- 14.3 GB
Nemotron-Cascade-2-30B-A3B
- Parameters
- 32B
- Context
- 256K
- Q4_K_M file
- 12.4 GB–27.0 GB
granite-4.0-h-micro
- Parameters
- 3.2B
- Context
- 128K
- Q4_K_M file
- 1.94 GB
Qwen3.8-35B-A3B-Distill
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 13.8 GB–30.3 GB
Nanbeige4.1-3B
- Parameters
- 3.9B
- Context
- 256K
- Q4_K_M file
- 2.45 GB
Magistral-Small-2509
- Parameters
- 24B
- Context
- 128K
- Q4_K_M file
- 14.3 GB
VibeThinker-3B
- Parameters
- 3.1B
- Context
- 128K
- Q4_K_M file
- 2.10 GB
MiMo-V2.6-Flash-MOPD
- Parameters
- 309B total · 15B active parameters
- Context
- 1M
- Q4_K_M file
- 191.2 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
Meta-Llama-3.1-70B-Instruct
- Parameters
- 71B
- Context
- 128K
- Q4_K_M file
- 42.5 GB
AliceAI-Foundation-80B-A3B-Base
- Parameters
- 81B
- Context
- 256K
- Q4_K_M file
- 32.0 GB–68.0 GB
Ring-2.5-1T
- Parameters
- 1012B
- Context
- 128K
- Q4_K_M file
- 601.7 GB
granite-guardian-3.3-8b
- Parameters
- 8.2B
- Context
- 128K
- Q4_K_M file
- 4.94 GB
GLM-4.6V
- Parameters
- 108B
- Context
- 128K
- Q4_K_M file
- 63.9 GB
MiniCPM-SALA
- Parameters
- 9.5B
- Context
- 512K
- Q4_K_M file
- 3.73 GB–8.57 GB
Swift-1.5-Qwen3.8-27b
- Parameters
- 28B
- Context
- 256K
- Q4_K_M file
- 10.9 GB–26.0 GB
Solar-Open2-250B
- Parameters
- 250B
- Context
- 1M
- Q4_K_M file
- 149.7 GB
zeta-2.1
- Parameters
- 8.3B
- Context
- 32K
- Q4_K_M file
- 5.07 GB
MiniMax-Text-01
- Parameters
- 456B
- Context
- 10M
- Q4_K_M file
- 179.6 GB–380.8 GB
Skyfall-36B-v2
- Parameters
- 37B
- Context
- 32K
- Q4_K_M file
- 22.4 GB
ERNIE-4.5-300B-A47B-PT
- Parameters
- 300B
- Context
- 128K
- Q4_K_M file
- 118.3 GB–251.0 GB
Hermes-3-Llama-3.1-70B
- Parameters
- 71B
- Context
- 128K
- Q4_K_M file
- 42.5 GB
LensVLM-9B
- Parameters
- 9.4B
- Context
- 256K
- Q4_K_M file
- 3.71 GB–10.2 GB
UnslopNemo-12B-v4.1
- Parameters
- 12B
- Context
- 1000K
- Q4_K_M file
- 7.48 GB
LongCat-2.0
- Parameters
- 1776B
- Context
- 256K
- Q4_K_M file
- 699.1 GB–1474.3 GB
Llama-4-Scout-17B-16E-Instruct
- Parameters
- 109B
- Context
- 10M
- Q4_K_M file
- 42.8 GB–92.5 GB
Mistral-Large-3-675B-Instruct-2512
- Parameters
- 675B total · 673B language model · 41B active
- Context
- 256K
- Q4_K_M file
- 402.7 GB
Trinity-Large-Thinking
- Parameters
- 399B
- Context
- 256K
- Q4_K_M file
- 241.8 GB
MiMo-V2.6-Pro-MOPD
- Parameters
- 1.02T total · 42B active parameters
- Context
- 1M
- Q4_K_M file
- 627.8 GB
The checkpoint uses packed/fused storage; its storage total is not treated as a logical parameter count.
L3-8B-Lunaris-v1
- Parameters
- 8.0B
- Context
- 8K
- Q4_K_M file
- 4.92 GB
Atria-Dawn-Preview
- Parameters
- 753B
- Context
- 1M
- Q4_K_M file
- 446.4 GB
Hermes-4-70B
- Parameters
- 71B
- Context
- 128K
- Q4_K_M file
- 42.5 GB
Holo4-35B-A3B
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 13.8 GB–30.3 GB
MythoMax-L2-13b
- Parameters
- unknown
- Context
- 4K
- Weight file
- no size
Sizeno data1.4K downloads / 30dNex-N2-mini
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 13.8 GB–30.3 GB
gemma-2-27b-it
- Parameters
- 27B
- Context
- 8K
- Q4_K_M file
- 17.3 GB
Hermes-3-Llama-3.1-405B
- Parameters
- 406B
- Context
- 128K
- Q4_K_M file
- 243.1 GB
GigaChat3.5-432B-A28B-Reasoning
- Parameters
- 438B
- Context
- 256K
- Q4_K_M file
- 172.5 GB–365.1 GB
Llama-4-Maverick-17B-128E-Instruct
- Parameters
- 402B
- Context
- 1M
- Q4_K_M file
- 158.1 GB–335.2 GB
L3.3-70B-Euryale-v2.3
- Parameters
- 71B
- Context
- 128K
- Q4_K_M file
- 42.5 GB
Nex-N2-Pro
- Parameters
- 397B
- Context
- 256K
- Q4_K_M file
- 238.8 GB
llm-jp-4.1-8b-thinking
- Parameters
- 8.6B
- Context
- 64K
- Q4_K_M file
- 5.31 GB
Hermes-4-405B
- Parameters
- 406B
- Context
- 128K
- Q4_K_M file
- 243.1 GB
llm-jp-4.1-33b-thinking
- Parameters
- 33B
- Context
- 64K
- Q4_K_M file
- 20.2 GB
magnum-v4-72b
- Parameters
- 73B
- Context
- 32K
- Q4_K_M file
- 47.4 GB
llm-jp-4.1-32b-a3b-thinking
- Parameters
- 32B
- Context
- 64K
- Q4_K_M file
- 19.6 GB
reka-flash-3
- Parameters
- 21B
- Context
- 32K
- Q4_K_M file
- 12.6 GB
reka-edge-2603
- Parameters
- 7.1B
- Context
- 16K
- Q4_K_M file
- 2.81 GB–6.88 GB
Holo4-27B
- Parameters
- 27B
- Context
- 256K
- Q4_K_M file
- 10.8 GB–25.7 GB
ReMM-SLERP-L2-13B
- Parameters
- unknown
- Context
- 4K
- Q5_K_M file
- 9.23 GB
automotive
- Parameters
- 35B
- Context
- 256K
- Q4_K_M file
- 20.8 GB
L3.1-70B-Euryale-v2.2
- Parameters
- unknown
- Context
- 128K
- Weight file
- no size
Sizeno data320 downloads / 30dKolibri-1-BF16
- Parameters
- 78B
- Context
- 256K
- Q4_K_M file
- 47.5 GB
Looking for a fine-tune or a GGUF repository? Paste its Hugging Face link →
Looking for a device instead? Browse the hardware directory →