---
base_model: keyvan-ai/Mankei-1B-Chat
base_model_relation: quantized
license: apache-2.0
language:
- de
- en
pipeline_tag: text-generation
tags:
- gguf
- llama
- german
- deutsch
- cpu
- ollama
- llama.cpp
---

# Mankei-1B-Chat — GGUF
GGUF-Quantisierungen von **[keyvan-ai/Mankei-1B-Chat](https://huggingface.co/keyvan-ai/Mankei-1B-Chat)** für **llama.cpp** und **Ollama** — läuft auf der CPU.
| Quantisierung | Größe | Download |
|---|---|---|
| f16 | 1,9 GB | [Mankei-1B-Chat-f16.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-f16.gguf) |
| Q8_0 | 1,0 GB | [Mankei-1B-Chat-q8_0.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q8_0.gguf) |
| Q6_K | 854 MB | [Mankei-1B-Chat-q6_k.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q6_k.gguf) |
| Q5_K_M | 727 MB | [Mankei-1B-Chat-q5_k_m.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q5_k_m.gguf) |
| Q4_K_M | 637 MB | [Mankei-1B-Chat-q4_k_m.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q4_k_m.gguf) |
| Q3_K_M | 512 MB | [Mankei-1B-Chat-q3_k_m.gguf](https://huggingface.co/keyvan-ai/Mankei-1B-Chat-GGUF/blob/main/Mankei-1B-Chat-q3_k_m.gguf) |
```bash
# Ollama
ollama run hf.co/keyvan-ai/Mankei-1B-Chat-GGUF:Q4_K_M
# llama.cpp
llama-cli -hf keyvan-ai/Mankei-1B-Chat-GGUF:Q4_K_M
```
Empfohlenes Sampling: `temperature 0.7 · top_p 0.9 · repetition_penalty 1.15`.