GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

Benson-Chen/tether-gguf-models overview

Benson-Chen/tether-gguf-models GGUF downloads for local AI inference with guIDE.

ggufendpoints_compatibleregion:usconversational

Runs locally from ~235.9 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
2,271
Likes
0
Pipeline

Repository Files & Downloads

46 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
bonsai-1.7B/Bonsai-1.7B-Q1_0.ggufGGUFQ1_0236.8 MBDownload
bonsai-1.7B/Bonsai-1.7B-Q2_0.ggufGGUFQ2_0441.8 MBDownload
bonsai-27B/Bonsai-27B-Q2_0.ggufGGUFQ2_06.67 GBDownload
bonsai-4B/Bonsai-4B-Q1_0.ggufGGUFQ1_0545.8 MBDownload
bonsai-4B/Bonsai-4B-Q2_0.ggufGGUFQ2_01.00 GBDownload
bonsai-8B/Bonsai-8B-Q1_0.ggufGGUFQ1_01.08 GBDownload
bonsai-8B/Bonsai-8B-Q2_0.ggufGGUFQ2_02.03 GBDownload
lfm2-1.2B/LFM2-1.2B-F16.ggufGGUFF162.18 GBDownload
lfm2-1.2B/LFM2-1.2B-Q4_K_M.ggufGGUFQ4_K_M697.0 MBDownload
lfm2-1.2B/LFM2-1.2B-TQ2_0.ggufGGUFGGUF362.5 MBDownload
minicpm5-1B/MiniCPM5-1B-F16.ggufGGUFF162.02 GBDownload
minicpm5-1B/MiniCPM5-1B-Q4_K_M.ggufGGUFQ4_K_M656.2 MBDownload
minicpm5-1B/MiniCPM5-1B-TQ2_0.ggufGGUFGGUF436.7 MBDownload
qwen3-0.6B/Qwen3-0.6B-Q4_K_M.ggufGGUFQ4_K_M378.3 MBDownload
qwen3-0.6B/Qwen3-0.6B-TQ2_0_Tether.ggufGGUFGGUF235.9 MBDownload
qwen3-1.7B/Qwen3-1.7B-BF16.ggufGGUFBF163.79 GBDownload
qwen3-1.7B/Qwen3-1.7B-Q2_K.ggufGGUFQ2_K741.8 MBDownload
qwen3-1.7B/Qwen3-1.7B-Q3_K_M.ggufGGUFQ3_K_M896.0 MBDownload
qwen3-1.7B/Qwen3-1.7B-Q4_0.ggufGGUFQ4_01005.6 MBDownload
qwen3-1.7B/Qwen3-1.7B-Q4_K_M.ggufGGUFQ4_K_M1.03 GBDownload
qwen3-1.7B/Qwen3-1.7B-Q4_K_M_imat.ggufGGUFQ4_K_M_IMAT1.19 GBDownload
qwen3-1.7B/Qwen3-1.7B-TQ1_0.ggufGGUFGGUF533.1 MBDownload
qwen3-1.7B/Qwen3-1.7B-TQ2_0.ggufGGUFGGUF596.1 MBDownload
qwen3-1.7B/Qwen3-1.7B-TQ2_0_128.ggufGGUFGGUF442.0 MBDownload
qwen3-4B/Qwen3-4B-BF16.ggufGGUFBF167.50 GBDownload
qwen3-4B/Qwen3-4B-Q4_K_M_imat.ggufGGUFQ4_K_M_IMAT2.33 GBDownload
qwen3-4B/Qwen3-4B-TQ2_0_128.ggufGGUFGGUF1.00 GBDownload
qwen3-8B/Qwen3-8B-BF16.ggufGGUFBF1615.26 GBDownload
qwen3-8B/Qwen3-8B-Q4_K_M_imat.ggufGGUFQ4_K_M_IMAT4.68 GBDownload
qwen3-8B/Qwen3-8B-TQ2_0_128.ggufGGUFGGUF2.03 GBDownload
qwen3.5-0.8B/Qwen3.5-0.8B-BF16.ggufGGUFBF161.41 GBDownload
qwen3.5-0.8B/Qwen3.5-0.8B-Q4_K_M.ggufGGUFQ4_K_M503.1 MBDownload
qwen3.5-0.8B/Qwen3.5-0.8B-TQ2_0.ggufGGUFGGUF333.6 MBDownload
qwen3.5-2B/Qwen3.5-2B-BF16.ggufGGUFBF163.52 GBDownload
qwen3.5-2B/Qwen3.5-2B-Q4_K_M-imat.ggufGGUFQ4_K_M1.22 GBDownload
qwen3.5-2B/Qwen3.5-2B-Q4_K_M.ggufGGUFQ4_K_M1.19 GBDownload
qwen3.5-2B/Qwen3.5-2B-TQ2_0_128.ggufGGUFGGUF489.1 MBDownload
qwen3.5-2b-allternary/qwen3.5-2b-allternary-TQ2_0_128.ggufGGUFGGUF489.1 MBDownload
qwen3.5-4B/Qwen3.5-4B-BF16.ggufGGUFBF167.85 GBDownload
qwen3.5-4B/Qwen3.5-4B-TQ2_0_128.ggufGGUFGGUF1.05 GBDownload
qwen3.5-4b-allternary/qwen3.5-4b-allternary-TQ2_0_128.ggufGGUFGGUF1.05 GBDownload
qwen3.5-9B/Qwen3.5-9B-TQ2_0_128.ggufGGUFGGUF2.23 GBDownload
qwen3.5-vlm-2B/Qwen3.5_VLM-2B-TQ2_0_128.ggufGGUFGGUF489.1 MBDownload
qwen3.5-vlm-4B/Qwen3.5_VLM-4B-TQ2_0_128.ggufGGUFGGUF1.05 GBDownload
qwen3.6-35B-A3B/Qwen3.6-35B-A3B-TQ2_0_128.ggufGGUFGGUF8.66 GBDownload
qwen3.6-35B/Qwen3.6-35B-TQ2_0-router-Q4_K.ggufGGUFQ4_K8.34 GBDownload

Model Details

Model IDBenson-Chen/tether-gguf-models
AuthorBenson-Chen
Pipeline
License
Base model
Last modified2026-08-20T22:55:14.000Z

Run Benson-Chen/tether-gguf-models with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models