GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →

Models for 24 GB VRAM

Workstation GPUs with 24 GB — near-full quants and larger context. Sorted by Hugging Face downloads. Smallest GGUF file size shown per model.

deepreinforce-ai/Ornith-1.0-35B-GGUF
deepreinforce-ai · from 19.71 GB · 1,838,371 downloads
bloomer010/Ling-3.0-flash-GGUF
bloomer010 · from 18.13 GB · 42,727 downloads
CodeFault/Nvidia-Qwen3.6-27B-NVFP4-GGUF
CodeFault · from 16.63 GB · 27,958 downloads
mlasli/Qwen3.8-27B-Heretic-Uncensored-Q5_K_M-GGUF
mlasli · from 18.33 GB · 23,559 downloads
AnonimousA/Qwen3.8-Flash-Next-REAP-320-GGUF
AnonimousA · from 17.26 GB · 22,026 downloads
poolside/Laguna-XS-2.1-GGUF
poolside · from 18.88 GB · 12,094 downloads
neko-legends/Qwen3.6-27B-NVFP4-MTP-GGUF
neko-legends · from 21.58 GB · 12,072 downloads
neko-legends/Qwen3.6-35B-A3B-NVFP4-MTP-GGUF
neko-legends · from 21.33 GB · 10,346 downloads
jashepp/Qwable-v1-35B-A3B-MXFP4_MOE_Hybrid-Imatrix-GGUF
jashepp · from 18.87 GB · 7,917 downloads
thread13/Kwaipilot_KAT-Coder-V2.5-Dev-GGUF-MTP
thread13 · from 18.35 GB · 4,755 downloads
williamliao/Qwen3.6-27B-Unsloth-NVFP4-Experimental-GGUF
williamliao · from 21.58 GB · 4,738 downloads
s-batman/Ornith-1.0-35B-NVFP4-MTP-GGUF
s-batman · from 18.91 GB · 4,548 downloads
wangzhang/Qwen3.6-35B-A3B-abliterated-GGUF
wangzhang · from 19.71 GB · 4,313 downloads
mente-ai/uyu-2-28B-GGUF
mente-ai · from 21.56 GB · 4,291 downloads
AtomicChat/ornith-35b-GGUF
AtomicChat · from 19.71 GB · 3,852 downloads
mudler/MiniMax-M2.7-APEX-GGUF
mudler · from 17.06 GB · 3,534 downloads
CodeFault/Unsloth-Qwen3.6-27B-NVFP4-GGUF
CodeFault · from 18.71 GB · 3,485 downloads
plunderstruck/Nex-N2-mini-ROCmFP4-GGUF
plunderstruck · from 18.08 GB · 3,373 downloads
noctrex/Ornith-1.0-35B-MXFP4_MOE-GGUF
noctrex · from 19.01 GB · 3,333 downloads
wangzhang/gemma-4-31B-it-abliterated-GGUF
wangzhang · from 17.40 GB · 3,255 downloads
pragmaticcs/Qwen-35B-A3B-SignOfFour-Coder-GGUF
pragmaticcs · from 20.00 GB · 3,019 downloads
Baekpica/Qwen3.8-Flash-Next-Uncensored-Mixed-Quant-SSD-PLE-GGUF
Baekpica · from 18.06 GB · 3,003 downloads
Rabbit-Hole-Ai/Qwen3.8-27B-5090-goldilocks-GGUF
Rabbit-Hole-Ai · from 23.43 GB · 2,831 downloads
ggml-org/Nemotron-Nano-3-30B-A3B-GGUF
ggml-org · from 20.88 GB · 2,727 downloads
tngtech/Qwen3.6-27B-NVFP4-GGUF
tngtech · from 18.51 GB · 2,723 downloads
llm-jp/llm-jp-4-32b-a3b-thinking-gguf
llm-jp · from 19.93 GB · 2,698 downloads
neko-legends/Ornith-1.0-35B-AEON-Ultimate-Uncensored-NVFP4-GGUF-MTP
neko-legends · from 21.80 GB · 2,529 downloads
mudler/Nemotron-3-Nano-30B-A3B-APEX-GGUF
mudler · from 17.48 GB · 2,473 downloads
lmstudio-community/Laguna-XS-2.1-GGUF
lmstudio-community · from 18.88 GB · 2,453 downloads
Nimbz/Gemma-4-Gembrain-31B-GGUF
Nimbz · from 16.54 GB · 2,408 downloads
EZForever/gemma-4-31B-it-qat-uncensored-heretic-UDmerge-GGUF
EZForever · from 16.10 GB · 2,360 downloads
jakeroxs/KAT-Coder-V2.5-Dev-35B-A3B-MTP-ABLITERATED-GGUF
jakeroxs · from 20.22 GB · 2,309 downloads
williamliao/Qwen3.6-35B-A3B-NVFP4-GGUF
williamliao · from 21.10 GB · 2,267 downloads
felippeburk/Qwen3.8-27B-NVFP4-MTP-GGUF
felippeburk · from 18.30 GB · 2,231 downloads
hiratagoh/llm-jp-4-32b-a3b-thinking-GGUF
hiratagoh · from 16.37 GB · 2,186 downloads
mlasli/Qwen3.8-27B-Heretic-Uncensored-Q6_K-GGUF
mlasli · from 20.99 GB · 1,888 downloads
Elsephire/Qwen3.6-35B-A3B-Nex-N2-mini-80-20-Beta-GGUF
Elsephire · from 18.97 GB · 1,665 downloads
ggml-org/Laguna-XS-2.1-GGUF
ggml-org · from 18.22 GB · 1,654 downloads
fraQtl/Qwen3.6-35B-A3B-Hi-Fi-GGUF
fraQtl · from 19.97 GB · 1,614 downloads
a4lg/Qwen3.8-2.4T-A95B-MTP-ONLY-GGUF
a4lg · from 18.53 GB · 1,552 downloads
ggml-org/NVIDIA-Nemotron-3-Nano-30B-A3B-GGUF
ggml-org · from 20.88 GB · 1,381 downloads
Achilles1089/fable-coder-35B-A3B-GGUF
Achilles1089 · from 20.22 GB · 1,331 downloads
pragmaticcs/SignOfFour-GGUF
pragmaticcs · from 19.71 GB · 1,233 downloads
TobiasLogic/Qwen2.5-Coder-32B-abliterated-GGUF
TobiasLogic · from 18.49 GB · 1,212 downloads
AtomicChat/Qwen3.6-35B-A3B-GGUF
AtomicChat · from 19.71 GB · 1,103 downloads
IFM/K2-Horizon-7B-GGUF
IFM · from 16.77 GB · 964 downloads
Frosty40/Ornith-1.0-35B-GGUF-NVFP4
Frosty40 · from 19.60 GB · 927 downloads
singulared/Ornith-1.0-35B-MTP-GGUF
singulared · from 20.55 GB · 747 downloads
wacomctl672/Nemotron-3-Nano-Omni-30B-Abliterated-MM-GGUF
wacomctl672 · from 22.83 GB · 655 downloads
pragmaticcs/SignOfTheFour-GGUF
pragmaticcs · from 19.71 GB · 647 downloads
Frosty40/SIQ-1-35B-B70-Turbo-GGUF
Frosty40 · from 23.03 GB · 645 downloads
NjProVk/Ornith-1.5-35B-A3B-abliterated-GGUF
NjProVk · from 19.71 GB · 619 downloads
linuxid10t/Laguna-XS.2-GGUF
linuxid10t · from 16.84 GB · 614 downloads
mradermacher/Qwen3-Coder-Next-REAM-GGUF
mradermacher · from 20.56 GB · 581 downloads
UlukaDev/saturn-31b-Q4_K_M-GGUF
UlukaDev · from 17.40 GB · 557 downloads
meshllm/GLM-4.7-Flash-MTP-GGUF
meshllm · from 17.61 GB · 537 downloads
ProCreations/grug-35b-gguf
ProCreations · from 19.71 GB · 523 downloads
kdqemre/Qwen3.6-27B-Omnimerge-v4-MTP-Q4_K_L-GGUF
kdqemre · from 16.19 GB · 517 downloads
mudler/Qwen3.6-35B-A3B-NVFP4-GGUF
mudler · from 22.21 GB · 457 downloads
lmcoleman/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-MagicQuant-GGUF
lmcoleman · from 17.60 GB · 457 downloads
localweights/Qwen3.6-35B-A3B-MTP-IMAT-IQ4_XS-Q8nextn-GGUF
localweights · from 17.87 GB · 451 downloads
pertai/qwen38-et-27b-GGUF
pertai · from 20.89 GB · 427 downloads
mudler/Qwen3.6-27B-NVFP4-GGUF
mudler · from 23.73 GB · 416 downloads
iamchum/wp-qwen3.6-35b-a3b-wp-judge-v4-gguf
iamchum · from 23.47 GB · 415 downloads
majentik/gemma-4-26B-A4B-it-RotorQuant-GGUF-Q5_K_M
majentik · from 17.82 GB · 397 downloads
majentik/Qwen3.6-35B-A3B-RotorQuant-GGUF-Q4_K_M
majentik · from 19.71 GB · 397 downloads
Elsephire/Qwen3.6-35B-A3B-vocabulary-trimming-GGUF
Elsephire · from 18.69 GB · 396 downloads
backpack-run/Qwen3-Coder-30B-A3B-Instruct-GGUF
backpack-run · from 17.28 GB · 390 downloads
lmcoleman/Qwen3.6-35B-A3B-MagicQuant-GGUF
lmcoleman · from 20.19 GB · 384 downloads
artichoke42/Qwen3.6-27B-KR-GGUF
artichoke42 · from 18.07 GB · 362 downloads
majentik/gemma-4-31B-it-RotorQuant-GGUF-Q4_K_M
majentik · from 17.40 GB · 360 downloads
Elsephire/Qwen3.6-35B-A3B-Ornith-80-20-Beta-GGUF
Elsephire · from 18.97 GB · 348 downloads
andreaborio/Qwen3.6-35B-A3B-DS4-GGUF
andreaborio · from 19.38 GB · 343 downloads
Joakimpalm-Zen/Qwen3-Coder-30B-A3B-Instruct-keep120-Q4_K_M-GGUF
Joakimpalm-Zen · from 16.33 GB · 342 downloads
CyberNative-AI/Qwen36-35B-A3B-CN-Q4KM-MTP-GGUF
CyberNative-AI · from 20.22 GB · 331 downloads
professorf/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16-gguf
professorf · from 17.37 GB · 328 downloads
NexusProjectsAI/Nemotron-3-Nano-30B-A3B-Nexus-Agents-GGUF
NexusProjectsAI · from 22.83 GB · 314 downloads
AtomicChat/qwen-agentworld-35b-GGUF
AtomicChat · from 19.71 GB · 293 downloads
xCloudinfo/Qwen3.6-35B-A3B-Uncensored-xCloud-GGUF
xCloudinfo · from 19.71 GB · 292 downloads
thecodehaider/Qwen2.5-32B-Instruct-GGUF
thecodehaider · from 18.49 GB · 291 downloads
DavidAU/L3-MOE-8X8B-Dark-Planet-8D-Mirrored-Chaos-47B-GGUF
DavidAU · from 16.55 GB · 282 downloads
majentik/gemma-4-26B-A4B-RotorQuant-GGUF-Q5_K_M
majentik · from 17.82 GB · 281 downloads
Blackroot/Ammeg-26B-GGUF-Q6
Blackroot · from 21.08 GB · 279 downloads
artichoke42/Qwen3.6-27B-KR-MTP-GGUF
artichoke42 · from 18.35 GB · 271 downloads
majentik/gemma-4-31B-it-RotorQuant-GGUF-Q5_K_M
majentik · from 20.35 GB · 271 downloads
locailabs/Juno-N-Coder-25B-A3B-GGUF
locailabs · from 18.16 GB · 267 downloads
majentik/gemma-4-31B-RotorQuant-GGUF-Q4_K_M
majentik · from 17.40 GB · 259 downloads
Joakimpalm-Zen/Qwen3-30B-A3B-selective-attnQ8_0-expQ4_0-GGUF
Joakimpalm-Zen · from 16.75 GB · 257 downloads
majentik/gemma-4-31B-RotorQuant-GGUF-Q5_K_M
majentik · from 20.35 GB · 255 downloads

Run models locally with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models