--- license: gemma base_model: google/gemma-4-E4B-it-assistant tags: - gguf - llama.cpp - gemma4 - mtp - speculative-decoding library_name: gguf --- # Gemma 4 E4B — MTP (assistant) head · GGUF `google/gemma-4-E4B-it-assistant` (Gemma 4 MTP / `gemma4-assistant` kafası) modelinin llama.cpp GGUF dönüşümleri. Bu dosyalar **ayrı MTP kafasıdır** (spekülatif üretim / draft-mtp) — tek başına sohbet modeli değildir; bir gemma4 E4B ana modeliyle birlikte kullanılır. ## Dosyalar | Dosya | Tip | |-------|-----| | `gemma-4-E4B-it-assistant-f16.gguf` | F16 | | `gemma-4-E4B-it-assistant-Q4_0.gguf` | Q4_0 | | `gemma-4-E4B-it-assistant-Q6_K.gguf` | Q6_K | | `gemma-4-E4B-it-assistant-Q8_0.gguf` | Q8_0 | ## Not Kafanın parametrelerinin büyük kısmı token gömmesindedir; daha düşük bitlerde (Q4_0) MTP kabul oranı bir miktar düşebilir. Kabul oranı en yüksek sürüm F16'dır. Dönüşüm llama.cpp commit `f955e39` ile yapılmıştır.