How to use from
llama.cpp
Install (macOS, Linux)
curl -LsSf https://llama.app/install.sh | sh
# Start a local OpenAI-compatible server with a web UI:
llama serve -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
# Run inference directly in the terminal:
llama cli -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
Install from WinGet (Windows)
winget install llama.cpp
# Start a local OpenAI-compatible server with a web UI:
llama serve -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
# Run inference directly in the terminal:
llama cli -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
Use pre-built binary
# Download pre-built binary from:
# https://github.com/ggerganov/llama.cpp/releases
# Start a local OpenAI-compatible server with a web UI:
./llama-server -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
# Run inference directly in the terminal:
./llama-cli -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
Build from source code
git clone https://github.com/ggerganov/llama.cpp.git
cd llama.cpp
cmake -B build
cmake --build build -j --target llama-server llama-cli
# Start a local OpenAI-compatible server with a web UI:
./build/bin/llama-server -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
# Run inference directly in the terminal:
./build/bin/llama-cli -hf NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
Use Docker
docker model run hf.co/NeveAI/Neve-Muse-3-26B-GGUF:IQ4_XS
Quick Links

Neve-Muse-3-26B-GGUF

Introdução

O Neve Muse 3 é um modelo de linguagem de última geração focado em conversação para simulação de interações humanas. Esta versão em formato GGUF foi otimizada pela NeveAI para oferecer o equilíbrio ideal entre precisão lógica e eficiência computacional.


Destaques do Modelo

Este modelo foi desenvolvido para conversação, escrita criativa e geração de respostas com estilo mais natural, focando em:

  • Conversação e Interação Natural: Mantém as capacidades de conversação, compreensão de contexto e seguimento de instruções do Gemma 4 26B A4B, produzindo respostas mais naturais e menos previsíveis.
  • Roleplay e Personalidades: Otimizado para interpretação de personagens, simulação de personalidades e manutenção de estilos, emoções e características comportamentais durante interações prolongadas.
  • Escrita Criativa e Narrativa: Ajustado exclusivamente com dados narrativos para reduzir clichês, melhorar a variedade de expressões e produzir histórias, cenas e diálogos com estilo mais distinto.
  • Raciocínio e Aderência a Prompts: Preserva as capacidades de raciocínio, conhecimento, compreensão de linguagem e seguimento de instruções do modelo-base, incluindo suporte a modos configuráveis de pensamento.

Detalhes da Arquitetura

  • Arquitetura: Transformer autorregressivo multimodal com arquitetura Mixture-of-Experts, baseado no Gemma 4 26B A4B, com suporte a texto e visão quando utilizado com um arquivo MMProj compatível.
  • Parâmetros: ~26B de parâmetros totais, com aproximadamente 4B ativados por token durante a inferência.
  • Janela de Contexto: Até 262.144 tokens.
  • Camadas: 30 camadas Transformer com atenção local deslizante e atenção global, 16 cabeças de atenção, 8 cabeças de chave e valor, 128 especialistas e 8 especialistas ativados por token.
  • Fine-tuning: Ajuste cirúrgico de estilo realizado exclusivamente sobre a camada de saída lm_head, modificando apenas um tensor da arquitetura para reduzir clichês e alterar o estilo de escrita sem substituir as capacidades centrais do modelo-base.

Como utilizar (GGUF)

Este modelo é compatível com llama.cpp, Ollama, LM Studio e outras ferramentas que suportam o formato GGUF. Foco direcionado ao uso do modelo na plataforma autoral da organização NeveAI

Licença

Este repositório e os pesos do modelo estão licenciados sob a Licença Apache 2.0.

Contato

Se tiver qualquer dúvida, por favor, levante um issue ou entre em contato conosco em NeveIA.

Downloads last month
445
GGUF
Model size
26B params
Architecture
gemma4
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for NeveAI/Neve-Muse-3-26B-GGUF

Quantized
(3)
this model

Collection including NeveAI/Neve-Muse-3-26B-GGUF