--- base_model: keyvan-ai/Mankei-1B-Chat base_model_relation: quantized license: apache-2.0 language: - de - en pipeline_tag: text-generation tags: - gguf - llama - german - deutsch - cpu - ollama - llama.cpp ---

Mankei

# Mankei-1B-Chat — GGUF GGUF-Quantisierungen von **[keyvan-ai/Mankei-1B-Chat](https://huggingface.co/keyvan-ai/Mankei-1B-Chat)** für **llama.cpp** und **Ollama** — läuft auf der CPU. | Quantisierung | Größe | Download | |---|---|---| | f16 | 1,9 GB | [Mankei-1B-Chat-f16.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-f16.gguf) | | Q8_0 | 1,0 GB | [Mankei-1B-Chat-q8_0.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q8_0.gguf) | | Q6_K | 854 MB | [Mankei-1B-Chat-q6_k.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q6_k.gguf) | | Q5_K_M | 727 MB | [Mankei-1B-Chat-q5_k_m.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q5_k_m.gguf) | | Q4_K_M | 637 MB | [Mankei-1B-Chat-q4_k_m.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q4_k_m.gguf) | | Q3_K_M | 512 MB | [Mankei-1B-Chat-q3_k_m.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q3_k_m.gguf) | ```bash # Ollama ollama run hf.co/keyvan-ai/Mankei-1B-Chat-GGUF:Q4_K_M # llama.cpp llama-cli -hf keyvan-ai/Mankei-1B-Chat-GGUF:Q4_K_M ``` Empfohlenes Sampling: `temperature 0.7 · top_p 0.9 · repetition_penalty 1.15`.