gustajunq/lumen-qwen-3.5-2b-gguf overview
Lumen Qwen 3.5 2B — GGUF Fine tune do Qwen 3.5 2B com foco em português brasileiro , raciocínio estruturado e personalidades regionais autênticas. Desenvolvido…
Runs locally from ~1.19 GB disk (4 GB VRAM class GPUs with llama.cpp / guIDE).
Repository Files & Downloads
| File | Type | Quantization | Size | Link |
|---|---|---|---|---|
| model-q4_k_m.gguf | GGUF | Q4_K_M | 1.19 GB | Download |
Model Details
| Model ID | gustajunq/lumen-qwen-3.5-2b-gguf |
|---|---|
| Author | gustajunq |
| Pipeline | text-generation |
| License | apache-2.0 |
| Base model | Qwen/Qwen3.5-2B |
| Last modified | 2026-06-20T02:57:34.000Z |
Model README
---
language:
- pt
- en
- es
license: apache-2.0
base_model: Qwen/Qwen3.5-2B
tags:
- fine-tuned
- portuguese
- brazilian-portuguese
- gguf
- llama-cpp
- text-generation
- chain-of-thought
- unsloth
pipeline_tag: text-generation
---
Lumen Qwen 3.5 2B — GGUF
> Fine-tune do Qwen 3.5 2B com foco em português brasileiro, raciocínio estruturado e personalidades regionais autênticas.
> Desenvolvido pela SynastrIA como parte do projeto Lumen.
> new gguf in here.
---
Sobre o modelo
O Lumen Qwen 3.5 2B é um fine-tune do Qwen 3.5 2B Instruct com foco no mercado brasileiro. O objetivo foi ir além da simples tradução de comportamentos do inglês — o modelo foi treinado para entender e reproduzir o português brasileiro como ele realmente é falado, com suas variações regionais, nuances culturais e jeito próprio de raciocinar.
O que foi treinado
Personalidades regionais autênticas
O modelo foi treinado com características linguísticas e culturais de quatro regiões brasileiras:
- Paulista
- Carioca
- Nordestino
- Baiano(a)
Sem caricaturas. O objetivo foi capturar o ritmo, a cadência e a atitude de cada região — não um estereótipo.
Chain of Thought em português
Raciocínio passo a passo naturalmente em PT-BR. A maioria dos modelos pensa em inglês por baixo mesmo quando responde em português — aqui o raciocínio acontece na língua certa.
Personalidade mais definida
A base do Qwen 3.5 é bastante neutra. Este fine-tune adiciona caráter, consistência e presença ao modelo.
Maior robustez
- Resistente a jailbreaks simples
- Bloqueio de prompts maliciosos e tentativas de SQL Injection
- Não é um modelo uncensored — mas também não é engessado
Corte de treinamento estendido
Knowledge cutoff estendido até maio de 2026. Para dados mais recentes, RAG resolve o resto.
---
Download
| Quantização | Tamanho (aprox.) | Recomendado para |
|---|---|---|
| Q4_K_M | ~1.3 GB | Uso geral — melhor equilíbrio qualidade/tamanho |
---
Como usar
llama.cpp
./llama-cli \
-m lumen-qwen3.5-2b-q4_k_m.gguf \
-p "Você é um assistente brasileiro. Responda em português." \
-n 512
Ollama
ollama run hf.co/gustajunq/lumen-qwen-3.5-2b-gguf
LM Studio / GPT4All
Baixe o arquivo .gguf e importe diretamente pela interface.
---
Prompt format
O modelo segue o formato ChatML padrão do Qwen:
<|im_start|>system
Você é Lumen, um assistente desenvolvido pela SynastrIA.<|im_end|>
<|im_start|>user
Olá! Como você funciona?<|im_end|>
<|im_start|>assistant
---
Limitações
- Fine-tune focado em texto — o modelo base é multimodal, mas esta versão não foi treinada para visão (visão não foi afetada, original da Qwen)
- Personalidades regionais foram treinadas com dataset limitado — pode haver inconsistências em contextos muito específicos
- Como qualquer LLM, pode alucinar informações factuais
---
Sobre o projeto Lumen
O Lumen (do latim lux, luz) é o projeto de modelos de linguagem da SynastrIA com foco no mercado brasileiro. Inclui também o Lumen-TLM-138M, um Tiny Language Model open-source treinado de forma distribuída pela comunidade.
---
Licença
Este modelo é distribuído sob a licença Apache 2.0, seguindo a licença do modelo base (Qwen 3.5).
Uso comercial permitido.
Run gustajunq/lumen-qwen-3.5-2b-gguf with guIDE
Download guIDE — the AI-native code editor with local LLM inference and 69 built-in tools.
Source: Hugging Face · Compare models