GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

intextus/all-MiniLM-L6-v2-GGUF overview

all MiniLM L6 v2 GGUF This repository contains GGUF format model files for sentence transformers/all MiniLM L6 v2 https://huggingface.co/sentence transformers/…

ggufbertendpoints_compatibleregion:usfeature-extraction

Runs locally from ~18.7 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
Author

Repository Files & Downloads

10 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
all-MiniLM-L6-v2-F16.ggufGGUFF1644.1 MBDownload
all-MiniLM-L6-v2-F32.ggufGGUFF3286.7 MBDownload
all-MiniLM-L6-v2-Q2_K.ggufGGUFQ2_K18.7 MBDownload
all-MiniLM-L6-v2-Q3_K_M.ggufGGUFQ3_K_M19.4 MBDownload
all-MiniLM-L6-v2-Q4_0.ggufGGUFQ4_019.1 MBDownload
all-MiniLM-L6-v2-Q4_K_M.ggufGGUFQ4_K_M20.3 MBDownload
all-MiniLM-L6-v2-Q5_0.ggufGGUFQ5_020.4 MBDownload
all-MiniLM-L6-v2-Q5_K_M.ggufGGUFQ5_K_M21.4 MBDownload
all-MiniLM-L6-v2-Q6_K.ggufGGUFQ6_K23.4 MBDownload
all-MiniLM-L6-v2-Q8_0.ggufGGUFQ8_024.2 MBDownload

Model Details

Model IDintextus/all-MiniLM-L6-v2-GGUF
Authorintextus
Pipeline
License
Base model
Last modified2026-06-28T19:57:08.000Z

Model README

all-MiniLM-L6-v2-GGUF

This repository contains GGUF format model files for sentence-transformers/all-MiniLM-L6-v2, generated with the intextus BERT GGUF conversion pipeline.

These files are fully compatible with llama.cpp and intextus.

Available Files & Quantizations

  • all-MiniLM-L6-v2-F32.gguf: Full precision F32 (recommended for maximum accuracy and zero dequantization overhead on CPU).
  • all-MiniLM-L6-v2-F16.gguf: Half precision F16.
  • all-MiniLM-L6-v2-Q8_0.gguf: 8-bit quantization (recommended default, fast and near-lossless).
  • all-MiniLM-L6-v2-Q6_K.gguf: 6-bit quantization.
  • all-MiniLM-L6-v2-Q5_K_M.gguf: 5-bit quantization (Medium).
  • all-MiniLM-L6-v2-Q5_0.gguf: 5-bit quantization.
  • all-MiniLM-L6-v2-Q4_K_M.gguf: 4-bit quantization (Medium).
  • all-MiniLM-L6-v2-Q4_0.gguf: 4-bit quantization.
  • all-MiniLM-L6-v2-Q3_K_M.gguf: 3-bit quantization (Medium).
  • all-MiniLM-L6-v2-Q2_K.gguf: 2-bit quantization.

Run intextus/all-MiniLM-L6-v2-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models