NeveAI/Neve-Muse-3-26B-GGUF overview
<div align="center" <img src="https://cdn uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/uEgq1cKh6eWYsyWKbcqch.png" width="50%" </div <h1 a…
Runs locally from ~13.33 GB disk (16 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| Neve-Muse-3-26B-IQ4_XS.gguf | GGUF | IQ4_XS | 13.33 GB | Download |
Model Details
| Model ID | NeveAI/Neve-Muse-3-26B-GGUF |
|---|---|
| Author | NeveAI |
| Pipeline | text-generation |
| License | apache-2.0 |
| Base model | Gryphe/Gemma-4-26B-A4B-StyleTune |
| Last modified | 2026-07-13T15:35:43.000Z |
Model README
---
library_name: transformers
license: apache-2.0
pipeline_tag: text-generation
base_model: Gryphe/Gemma-4-26B-A4B-StyleTune
tags:
- NeveAI
- Neve
- Muse
---
<div align="center">
<img src="https://cdn-uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/uEgq1cKh6eWYsyWKbcqch.png" width="50%">
</div>
<h1 align="center">
Neve-Muse-3-26B-GGUF</h1>
<div align="center">
<a href="https://github.com/NeveIA">
<img src="https://cdn-uploads.huggingface.co/production/uploads/68a3ba234a7dfca33d72eee2/KQa7-ajynUAhTS-kxNtYT.png" width="20%" alt="NeveAI GitHub">
</a>
</div>
Introdução
O Neve Muse 3 é um modelo de linguagem de última geração focado em conversação para simulação de interações humanas. Esta versão em formato GGUF foi otimizada pela NeveAI para oferecer o equilíbrio ideal entre precisão lógica e eficiência computacional.
---
Destaques do Modelo
Este modelo foi desenvolvido para conversação, escrita criativa e geração de respostas com estilo mais natural, focando em:
- Conversação e Interação Natural: Mantém as capacidades de conversação, compreensão de contexto e seguimento de instruções do Gemma 4 26B A4B, produzindo respostas mais naturais e menos previsíveis.
- Roleplay e Personalidades: Otimizado para interpretação de personagens, simulação de personalidades e manutenção de estilos, emoções e características comportamentais durante interações prolongadas.
- Escrita Criativa e Narrativa: Ajustado exclusivamente com dados narrativos para reduzir clichês, melhorar a variedade de expressões e produzir histórias, cenas e diálogos com estilo mais distinto.
- Raciocínio e Aderência a Prompts: Preserva as capacidades de raciocínio, conhecimento, compreensão de linguagem e seguimento de instruções do modelo-base, incluindo suporte a modos configuráveis de pensamento.
Detalhes da Arquitetura
- Arquitetura: Transformer autorregressivo multimodal com arquitetura Mixture-of-Experts, baseado no Gemma 4 26B A4B, com suporte a texto e visão quando utilizado com um arquivo MMProj compatível.
- Parâmetros: ~26B de parâmetros totais, com aproximadamente 4B ativados por token durante a inferência.
- Janela de Contexto: Até 262.144 tokens.
- Camadas: 30 camadas Transformer com atenção local deslizante e atenção global, 16 cabeças de atenção, 8 cabeças de chave e valor, 128 especialistas e 8 especialistas ativados por token.
- Fine-tuning: Ajuste cirúrgico de estilo realizado exclusivamente sobre a camada de saída
lm_head, modificando apenas um tensor da arquitetura para reduzir clichês e alterar o estilo de escrita sem substituir as capacidades centrais do modelo-base.
Como utilizar (GGUF)
Este modelo é compatível com llama.cpp, Ollama, LM Studio e outras ferramentas que suportam o formato GGUF.
Foco direcionado ao uso do modelo na plataforma autoral da organização NeveAI
Licença
Este repositório e os pesos do modelo estão licenciados sob a Licença Apache 2.0.
Contato
Se tiver qualquer dúvida, por favor, levante um issue ou entre em contato conosco em NeveIA.
Run NeveAI/Neve-Muse-3-26B-GGUF with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models