GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

FalconSuzuki/Llama-3.1-Swallow-8B-v0.5-Q4_K_M-GGUF overview

Llama 3.1 Swallow 8B v0.5 Q4 K M GGUF This is a Q4 K M GGUF quantization of tokyotech llm/Llama 3.1 Swallow 8B v0.5 https://huggingface.co/tokyotech llm/Llama …

ggufbase_model:tokyotech-llm/Llama-3.1-Swallow-8B-v0.5base_model:quantized:tokyotech-llm/Llama-3.1-Swallow-8B-v0.5license:llama3.3endpoints_compatibleregion:us

Runs locally from ~4.58 GB disk (8 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline

Repository Files & Downloads

1 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
llama-3.1-swallow-8b-v0.5-Q4_K_M.ggufGGUFQ4_K_M4.58 GBDownload

Model Details

Model IDFalconSuzuki/Llama-3.1-Swallow-8B-v0.5-Q4_K_M-GGUF
AuthorFalconSuzuki
Pipeline
Licensellama3.3
Base modeltokyotech-llm/Llama-3.1-Swallow-8B-v0.5
Last modified2026-07-30T10:17:40.000Z

Model README

---

license: llama3.3

base_model: tokyotech-llm/Llama-3.1-Swallow-8B-v0.5

---

Llama-3.1-Swallow-8B-v0.5-Q4_K_M-GGUF

This is a Q4_K_M GGUF quantization of tokyotech-llm/Llama-3.1-Swallow-8B-v0.5, converted using llama.cpp.

Usage with Ollama

ollama run hf.co/FalconSuzuki/Llama-3.1-Swallow-8B-v0.5-Q4_K_M-GGUF:Q4_K_M

License

Please refer to the original model's license terms.

Run FalconSuzuki/Llama-3.1-Swallow-8B-v0.5-Q4_K_M-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models