GraySoft
Projects Models Compare Cloud benchmarks FAQ Download guIDE →
Model Intelligence Sheet

NeveAI/Neve-Muse-3-26B-GGUF overview

<div align="center" <img src="https://cdn uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/uEgq1cKh6eWYsyWKbcqch.png" width="50%" </div <h1 a…

transformersggufNeveAINeveMusetext-generationbase_model:Gryphe/Gemma-4-26B-A4B-StyleTunebase_model:quantized:Gryphe/Gemma-4-26B-A4B-StyleTunelicense:apache-2.0endpoints_compatibleregion:usimatrixconversational

Runs locally from ~13.33 GB disk (16 GB VRAM class GPUs with llama.cpp / guIDE).

Downloads
0
Likes
1
Pipeline
text-generation
Author

Repository Files & Downloads

1 GGUF files detected
Direct downloads for local inference
FileTypeQuantizationSizeLink
Neve-Muse-3-26B-IQ4_XS.ggufGGUFIQ4_XS13.33 GBDownload

Model Details

Model IDNeveAI/Neve-Muse-3-26B-GGUF
AuthorNeveAI
Pipelinetext-generation
Licenseapache-2.0
Base modelGryphe/Gemma-4-26B-A4B-StyleTune
Last modified2026-07-13T15:35:43.000Z

Model README

---

library_name: transformers

license: apache-2.0

pipeline_tag: text-generation

base_model: Gryphe/Gemma-4-26B-A4B-StyleTune

tags:

- NeveAI

- Neve

- Muse

---

<div align="center">

<img src="https://cdn-uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/uEgq1cKh6eWYsyWKbcqch.png" width="50%">

</div>

<h1 align="center">

Neve-Muse-3-26B-GGUF</h1>

<div align="center">

<a href="https://github.com/NeveIA">

<img src="https://cdn-uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/KQa7-ajynUAhTS-kxNtYT.png" width="20%" alt="NeveAI GitHub">

</a>

</div>

Introdução

O Neve Muse 3 é um modelo de linguagem de última geração focado em conversação para simulação de interações humanas. Esta versão em formato GGUF foi otimizada pela NeveAI para oferecer o equilíbrio ideal entre precisão lógica e eficiência computacional.

---

Destaques do Modelo

Este modelo foi desenvolvido para conversação, escrita criativa e geração de respostas com estilo mais natural, focando em:

  • Conversação e Interação Natural: Mantém as capacidades de conversação, compreensão de contexto e seguimento de instruções do Gemma 4 26B A4B, produzindo respostas mais naturais e menos previsíveis.
  • Roleplay e Personalidades: Otimizado para interpretação de personagens, simulação de personalidades e manutenção de estilos, emoções e características comportamentais durante interações prolongadas.
  • Escrita Criativa e Narrativa: Ajustado exclusivamente com dados narrativos para reduzir clichês, melhorar a variedade de expressões e produzir histórias, cenas e diálogos com estilo mais distinto.
  • Raciocínio e Aderência a Prompts: Preserva as capacidades de raciocínio, conhecimento, compreensão de linguagem e seguimento de instruções do modelo-base, incluindo suporte a modos configuráveis de pensamento.

Detalhes da Arquitetura

  • Arquitetura: Transformer autorregressivo multimodal com arquitetura Mixture-of-Experts, baseado no Gemma 4 26B A4B, com suporte a texto e visão quando utilizado com um arquivo MMProj compatível.
  • Parâmetros: ~26B de parâmetros totais, com aproximadamente 4B ativados por token durante a inferência.
  • Janela de Contexto: Até 262.144 tokens.
  • Camadas: 30 camadas Transformer com atenção local deslizante e atenção global, 16 cabeças de atenção, 8 cabeças de chave e valor, 128 especialistas e 8 especialistas ativados por token.
  • Fine-tuning: Ajuste cirúrgico de estilo realizado exclusivamente sobre a camada de saída lm_head, modificando apenas um tensor da arquitetura para reduzir clichês e alterar o estilo de escrita sem substituir as capacidades centrais do modelo-base.

Como utilizar (GGUF)

Este modelo é compatível com llama.cpp, Ollama, LM Studio e outras ferramentas que suportam o formato GGUF.

Foco direcionado ao uso do modelo na plataforma autoral da organização NeveAI

Licença

Este repositório e os pesos do modelo estão licenciados sob a Licença Apache 2.0.

Contato

Se tiver qualquer dúvida, por favor, levante um issue ou entre em contato conosco em NeveIA.

Run NeveAI/Neve-Muse-3-26B-GGUF with guIDE

Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.

Download guIDE → · Browse 524k+ models · Compare models

Source: Hugging Face · Compare models