GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

NeveAI/Neve-Cascade-S-90M-GGUF overview

<div align="center" <img src="https://cdn uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/uEgq1cKh6eWYsyWKbcqch.png" width="50%" </div <h1 a…

transformersggufNeveAINeveCascadeStext-generationbase_model:tiiuae/Falcon-H1-Tiny-90M-Instructbase_model:quantized:tiiuae/Falcon-H1-Tiny-90M-Instructlicense:apache-2.0endpoints_compatibleregion:usconversational

Runs locally from ~93.8 MB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
76
Likes
1
Pipeline
text-generation
Author

Repository Files & Downloads

1 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Neve-Cascade-S-90M-Q8_0.ggufGGUFQ8_093.8 MBDownload

Model Details

Model IDNeveAI/Neve-Cascade-S-90M-GGUF
AuthorNeveAI
Pipelinetext-generation
Licenseapache-2.0
Base modeltiiuae/Falcon-H1-Tiny-90M-Instruct
Last modified2026-07-08T00:36:48.000Z

Model README

---

library_name: transformers

license: apache-2.0

pipeline_tag: text-generation

base_model: tiiuae/Falcon-H1-Tiny-90M-Instruct

tags:

- NeveAI

- Neve

- CascadeS

---

<div align="center">

<img src="https://cdn-uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/uEgq1cKh6eWYsyWKbcqch.png" width="50%">

</div>

<h1 align="center">Neve-Cascade-S-90M-GGUF</h1>

<div align="center">

<a href="https://github.com/NeveIA">

<img src="https://cdn-uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/KQa7-ajynUAhTS-kxNtYT.png" width="20%" alt="NeveAI GitHub">

</a>

</div>

Introdução

O Neve Cascade S é um modelo de linguagem de última geração focado em baixo consumo para microtarefas. Esta versão em formato GGUF foi otimizada pela NeveAI para oferecer o equilíbrio ideal entre precisão lógica e eficiência computacional.

---

Detalhes da Arquitetura

  • Geração Autoregressiva de Alta Precisão: Modelo causal decoder-only focado em extrema eficiência estrutural, projetado para oferecer respostas fluidas.
  • Inovação Híbrida Transformer-Mamba: Arquitetura de vanguarda que combina a robustez analítica e o raciocínio dos Transformers com a eficiência de memória.
  • Ultra-Compacto e Acessível: Com uma contagem otimizada de 90 Milhões de parâmetros, oferece inferência ultrarrápida com um consumo de recursos ínfimo.

Como utilizar (GGUF)

Este modelo é compatível com llama.cpp, Ollama, LM Studio e outras ferramentas que suportam o formato GGUF.

Foco direcionado ao uso do modelo na plataforma autoral da organização NeveAI

Licença

Este repositório e os pesos do modelo estão licenciados sob a Licença Apache 2.0.

Contato

Se tiver qualquer dúvida, por favor, levante um issue ou entre em contato conosco em NeveIA.

Run NeveAI/Neve-Cascade-S-90M-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models