GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

shannonkun/rugpt3xl-1.3b-sft-gguf overview

Выход за пределы 128 токенов резко снижает качество, так как в этом gguf не активирован механизм sparse attention. Исправление требует принятие патча и пересоз…

ggufrudataset:IlyaGusev/saiga_preferencesbase_model:shannonkun/rugpt3xl-1.3b-sftbase_model:quantized:shannonkun/rugpt3xl-1.3b-sftlicense:mitendpoints_compatibleregion:usconversational

Runs locally from ~1.3 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
376
Likes
0
Pipeline

Repository Files & Downloads

7 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Sft_Full_20260610_050605-1.4B-F16.ggufGGUFF162.65 GBDownload
rugpt3xl_1.3B_sft_0.1-BF16.ggufGGUFBF162.65 GBDownload
rugpt3xl_1.3B_sft_0.1-IQ2_M.ggufGGUFIQ2_M547.6 MBDownload
rugpt3xl_1.3B_sft_0.1-IQ4_XS.ggufGGUFIQ4_XS766.3 MBDownload
rugpt3xl_1.3B_sft_0.1-Q5_K_M.ggufGGUFQ5_K_M1006.3 MBDownload
rugpt3xl_1.3B_sft_0.1-Q8_0.ggufGGUFQ8_01.42 GBDownload
rugpt3xl_imatrix.ggufGGUFGGUF1.3 MBDownload

Model Details

Model IDshannonkun/rugpt3xl-1.3b-sft-gguf
Authorshannonkun
Pipeline
Licensemit
Base modelshannonkun/rugpt3xl-1.3b-sft
Last modified2026-07-23T06:07:38.000Z

Model README

---

license: mit

language:

  • ru

base_model:

  • shannonkun/rugpt3xl-1.3b-sft

datasets:

  • IlyaGusev/saiga_preferences

---

Выход за пределы 128 токенов резко снижает качество, так как в этом gguf не активирован механизм sparse attention. Исправление требует принятие патча и пересоздание gguf: https://github.com/ggml-org/llama.cpp/pull/21161

Запускать лучше с шаблоном чата:

Run shannonkun/rugpt3xl-1.3b-sft-gguf with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models