GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

DevQuasar/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16-GGUF overview

<img src="https://raw.githubusercontent.com/csabakecskemeti/devquasar/main/dq logo black transparent.png" width="200"/ https://devquasar.com 'Make knowledge fr…

gguftext-generationbase_model:nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16base_model:quantized:nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16endpoints_compatibleregion:usconversational

Runs locally from ~3.81 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
1
Pipeline
text-generation
Author

Repository Files & Downloads

7 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Q2_K/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16.f16.gguf.Q2_K.ggufGGUFQ2_K16.68 GBDownload
Q3_K_M/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16.f16.gguf.Q3_K_M.ggufGGUFQ3_K_M18.49 GBDownload
Q4_K_M/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16.f16.gguf.Q4_K_M.ggufGGUFQ4_K_M22.83 GBDownload
Q5_K_M/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16.f16.gguf.Q5_K_M.ggufGGUFQ5_K_M24.25 GBDownload
Q6_K/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16.f16.gguf.Q6_K.ggufGGUFQ6_K31.21 GBDownload
Q8_0/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16.f16.gguf.Q8_0.ggufGGUFQ8_031.28 GBDownload
mtp-nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16.f16.ggufGGUFBF163.81 GBDownload

Model Details

Model IDDevQuasar/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16-GGUF
AuthorDevQuasar
Pipelinetext-generation
License
Base modelnvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16
Last modified2026-08-11T19:00:01.000Z

Model README

---

base_model:

  • nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16

pipeline_tag: text-generation

---

<img src="https://raw.githubusercontent.com/csabakecskemeti/devquasar/main/dq_logo_black-transparent.png" width="200"/>

'Make knowledge free for everyone'

!NOTE: while mtp drafter model is available in my test it has hurt the performance!

Quantized version of: nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16

<a href='https://ko-fi.com/L4L416YX7C' target='_blank'><img height='36' style='border:0px;height:36px;' src='https://storage.ko-fi.com/cdn/kofi6.png?v=6' border='0' alt='Buy Me a Coffee at ko-fi.com' /></a>

Run DevQuasar/nvidia.NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models