GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

cstr/ettin-reranker-400m-v1-GGUF overview

Ettin Reranker 400M — GGUF GGUF quantizations of cross encoder/ettin reranker 400m v1 https://huggingface.co/cross encoder/ettin reranker 400m v1 , a ModernBER…

crispembedggufrerankercross-encodermodernbertbase_model:cross-encoder/ettin-reranker-400m-v1base_model:quantized:cross-encoder/ettin-reranker-400m-v1license:apache-2.0region:us

Runs locally from ~241.7 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
0
Pipeline
Author

Repository Files & Downloads

4 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
ettin-reranker-400m-v1-f32.ggufGGUFF321.48 GBDownload
ettin-reranker-400m-v1-q4_k.ggufGGUFQ4_K241.7 MBDownload
ettin-reranker-400m-v1-q6_k.ggufGGUFQ6_K343.5 MBDownload
ettin-reranker-400m-v1-q8_0.ggufGGUFQ8_0405.4 MBDownload

Model Details

Model IDcstr/ettin-reranker-400m-v1-GGUF
Authorcstr
Pipeline
Licenseapache-2.0
Base modelcross-encoder/ettin-reranker-400m-v1
Last modified2026-08-22T18:11:16.000Z

Model README

---

license: apache-2.0

base_model: cross-encoder/ettin-reranker-400m-v1

tags:

- gguf

- reranker

- cross-encoder

- modernbert

- crispembed

library_name: crispembed

---

Ettin Reranker 400M — GGUF

GGUF quantizations of cross-encoder/ettin-reranker-400m-v1, a ModernBERT-based cross-encoder reranker (401.6M params, Apache-2.0).

Converted with CrispEmbed.

Files

| File | Quant | Size |

|------|-------|------|

| | F32 | 1585 MB |

| | Q8_0 | 425 MB |

| | Q4_K | 253 MB |

Architecture

  • Base: ModernBERT (28 layers, 1024 hidden)
  • Classifier head: Dense(1024→1024, GELU) → LayerNorm → Dense(1024→1)
  • Tokenizer: GPT-2 ByteLevel BPE (50368 tokens)

Usage

Run cstr/ettin-reranker-400m-v1-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models