How to use from the
Use from the
llama-cpp-python library
# !pip install llama-cpp-python

from llama_cpp import Llama

llm = Llama.from_pretrained(
	repo_id="NeveAI/Neve-Muse-4-24B-GGUF",
	filename="Neve-Muse-4-24B-Q4_K_M.gguf",
)
llm.create_chat_completion(
	messages = [
		{
			"role": "user",
			"content": "What is the capital of France?"
		}
	]
)

Neve-Muse-4-24B-GGUF

Introdução

O Neve Muse 4 é um modelo de linguagem de última geração focado em conversação para simulação de interações humanas. Esta versão em formato GGUF foi otimizada pela NeveAI para oferecer o equilíbrio ideal entre precisão lógica e eficiência computacional.


Destaques do Modelo

Este modelo foi desenvolvido para conversação, simulação humana e escrita criativa, focando em:

  • Sem Censura e Baixa Recusa: Modelo decensurado e abliterado, projetado para minimizar recusas, respostas moralizantes e restrições comportamentais convencionais. Pode abordar temas sensíveis, controversos, adultos ou explícitos com maior liberdade, seguindo diretamente as instruções e o contexto fornecidos pelo usuário.
  • Conversação e Simulação Humana: Otimizado para diálogos naturais, interpretação de personagens e simulação de personalidades e comportamentos humanos.
  • Roleplay e Personalidades: Desenvolvido para manter personagens, estilos, emoções e características comportamentais durante interações prolongadas.
  • Escrita Criativa e Narrativa: Combina especializações em storytelling, fantasia, aventura e prosa expressiva para produzir cenas e narrativas envolventes.
  • Aderência a Prompts e Contexto: Projetado para seguir instruções, cenários, perfis de personagem e regras de interação definidas pelo usuário.

Detalhes da Arquitetura

  • Arquitetura: Transformer denso e autorregressivo baseado na família Mistral Small 3.2, exclusivamente textual.
  • Parâmetros: ~24B de parâmetros, com o modelo completo ativo durante a inferência.
  • Janela de Contexto: Até 128K tokens.
  • Camadas: 40 camadas Transformer com Grouped-Query Attention, 32 cabeças de atenção e 8 cabeças de chave e valor.
  • Merge: Fusão em múltiplas etapas utilizando Model Stock, SLERP e NuSLERP, combinando modelos especializados em conversação, personalidade, roleplay, storytelling, fantasia e aventura.
  • Decensura: Submetido ao processo de abliteration Heretic com Magnitude-Preserving Orthogonal Ablation, reduzindo significativamente padrões de recusa aprendidos pelo modelo.

Como utilizar (GGUF)

Este modelo é compatível com llama.cpp, Ollama, LM Studio e outras ferramentas que suportam o formato GGUF. Foco direcionado ao uso do modelo na plataforma autoral da organização NeveAI

Licença

Este repositório e os pesos do modelo estão licenciados sob a Licença Apache 2.0.

Contato

Se tiver qualquer dúvida, por favor, levante um issue ou entre em contato conosco em NeveIA.

Downloads last month
200
GGUF
Model size
24B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

4-bit

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for NeveAI/Neve-Muse-4-24B-GGUF

Collection including NeveAI/Neve-Muse-4-24B-GGUF