GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

mmnga-o/llm-jp-4-33b-thinking-gguf overview

llm jp 4 33b thinking GGUF llm jp https://huggingface.co/llm jp さんが公開している llm jp 4 33b thinking https://huggingface.co/llm jp/llm jp 4 33b thinking のGGUFフォーマット…

ggufllama.cppjabase_model:llm-jp/llm-jp-4-33b-thinkingbase_model:quantized:llm-jp/llm-jp-4-33b-thinkingendpoints_compatibleregion:usimatrixconversational

Runs locally from ~12.19 GB disk (16 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
3
Pipeline
Author

Repository Files & Downloads

16 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
llm-jp-4-33b-thinking-IQ3_M.ggufGGUFIQ3_M14.06 GBDownload
llm-jp-4-33b-thinking-IQ3_S.ggufGGUFIQ3_S13.71 GBDownload
llm-jp-4-33b-thinking-IQ3_XXS.ggufGGUFIQ3_XXS12.19 GBDownload
llm-jp-4-33b-thinking-IQ4_NL.ggufGGUFIQ4_NL17.69 GBDownload
llm-jp-4-33b-thinking-IQ4_XS.ggufGGUFIQ4_XS16.76 GBDownload
llm-jp-4-33b-thinking-MXFP4_MOE.ggufGGUFGGUF32.88 GBDownload
llm-jp-4-33b-thinking-Q3_K_L.ggufGGUFQ3_K_L16.33 GBDownload
llm-jp-4-33b-thinking-Q3_K_M.ggufGGUFQ3_K_M15.10 GBDownload
llm-jp-4-33b-thinking-Q4_0.ggufGGUFQ4_017.65 GBDownload
llm-jp-4-33b-thinking-Q4_K_M.ggufGGUFQ4_K_M18.78 GBDownload
llm-jp-4-33b-thinking-Q4_K_S.ggufGGUFQ4_K_S17.79 GBDownload
llm-jp-4-33b-thinking-Q5_0.ggufGGUFQ5_021.40 GBDownload
llm-jp-4-33b-thinking-Q5_K_M.ggufGGUFQ5_K_M21.98 GBDownload
llm-jp-4-33b-thinking-Q5_K_S.ggufGGUFQ5_K_S21.40 GBDownload
llm-jp-4-33b-thinking-Q6_K.ggufGGUFQ6_K25.39 GBDownload
llm-jp-4-33b-thinking-Q8_0.ggufGGUFQ8_032.88 GBDownload

Model Details

Model IDmmnga-o/llm-jp-4-33b-thinking-gguf
Authormmnga-o
Pipeline
License
Base modelllm-jp/llm-jp-4-33b-thinking
Last modified2026-08-19T10:52:38.000Z

Model README

---

base_model: llm-jp/llm-jp-4-33b-thinking

language:

- ja

tags:

- gguf

- llama.cpp

---

llm-jp-4-33b-thinking-GGUF

llm-jpさんが公開しているllm-jp-4-33b-thinkingのGGUFフォーマット変換版です。

imatrixのデータはTFMC/imatrix-dataset-for-japanese-llmを使用して作成しました。

llama.cpp

このモデルを使用するには、llm-jp版のllama.cppが必要です。

git clone https://github.com/llm-jp/llama.cpp
cd llama.cpp
cmake -B build -DGGML_CUDA=ON
cmake --build build --config Release -j

Usage

hf download mmnga-o/llm-jp-4-33b-thinking-gguf \
  llm-jp-4-33b-thinking-Q4_K_M.gguf \
  --local-dir .

./build/bin/llama-server \
  --model ./llm-jp-4-33b-thinking-Q4_K_M.gguf \
  --jinja \
  -rea on \
  --flash-attn on \
  -ngl 99 \
  --ctx-size 8192 \
  --port 8080

-nglは使用するGPUのVRAM容量に合わせて調整してください。

Run mmnga-o/llm-jp-4-33b-thinking-gguf with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models