matrixportalx commited on
Commit
0132a0a
·
verified ·
1 Parent(s): ba6ffaf

Upload README.md with huggingface_hub

Browse files
Files changed (1) hide show
  1. README.md +31 -0
README.md ADDED
@@ -0,0 +1,31 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ license: gemma
3
+ base_model: google/gemma-4-E4B-it-assistant
4
+ tags:
5
+ - gguf
6
+ - llama.cpp
7
+ - gemma4
8
+ - mtp
9
+ - speculative-decoding
10
+ library_name: gguf
11
+ ---
12
+
13
+ # Gemma 4 E4B — MTP (assistant) head · GGUF
14
+
15
+ `google/gemma-4-E4B-it-assistant` (Gemma 4 MTP / `gemma4-assistant` kafası)
16
+ modelinin llama.cpp GGUF dönüşümleri. Bu dosyalar **ayrı MTP kafasıdır**
17
+ (spekülatif üretim / draft-mtp) — tek başına sohbet modeli değildir; bir
18
+ gemma4 E4B ana modeliyle birlikte kullanılır.
19
+
20
+ ## Dosyalar
21
+ | Dosya | Tip |
22
+ |-------|-----|
23
+ | `gemma-4-E4B-it-assistant-f16.gguf` | F16 |
24
+ | `gemma-4-E4B-it-assistant-Q4_0.gguf` | Q4_0 |
25
+ | `gemma-4-E4B-it-assistant-Q6_K.gguf` | Q6_K |
26
+ | `gemma-4-E4B-it-assistant-Q8_0.gguf` | Q8_0 |
27
+
28
+ ## Not
29
+ Kafanın parametrelerinin büyük kısmı token gömmesindedir; daha düşük bitlerde
30
+ (Q4_0) MTP kabul oranı bir miktar düşebilir. Kabul oranı en yüksek sürüm F16'dır.
31
+ Dönüşüm llama.cpp commit `f955e39` ile yapılmıştır.