gemma-4-E4B-it-GGUF / scores /gemma-4-E4B-it-q6_k.ppx
eaddario's picture
Generate Perplexity, KLD, ARC, HellaSwag, MMLU, Truthful QA and WinoGrande scores
2c7e1e2 verified
Raw
History Blame Contribute Delete
1.67 kB
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
llama_model_loader: - type f32: 339 tensors
llama_model_loader: - type f16: 32 tensors
llama_model_loader: - type q5_1: 8 tensors
llama_model_loader: - type q8_0: 91 tensors
llama_model_loader: - type q5_K: 2 tensors
llama_model_loader: - type q6_K: 248 tensors
print_info: file format = GGUF V3 (latest)
print_info: file type = Q6_K
print_info: file size = 5.69 GiB (6.50 BPW)
====== Perplexity statistics ======
Mean PPL(Q) : 57.395025 ± 0.709393
Mean PPL(base) : 52.693235 ± 0.610088
Cor(ln(PPL(Q)), ln(PPL(base))): 98.51%
Mean ln(PPL(Q)/PPL(base)) : 0.085471 ± 0.002205
Mean PPL(Q)/PPL(base) : 1.089229 ± 0.002402
Mean PPL(Q)-PPL(base) : 4.701791 ± 0.150722
====== KL divergence statistics ======
Mean KLD: 0.006872 ± 0.000100
Maximum KLD: 3.890319
99.9% KLD: 0.332454
99.0% KLD: 0.064667
95.0% KLD: 0.022811
90.0% KLD: 0.013986
Median KLD: 0.002055
10.0% KLD: 0.000015
5.0% KLD: 0.000002
1.0% KLD: -0.000000
0.1% KLD: -0.000002
Minimum KLD: -0.000105
====== Token probability statistics ======
Mean Δp: -0.077 ± 0.006 %
Maximum Δp: 75.114%
99.9% Δp: 15.320%
99.0% Δp: 6.360%
95.0% Δp: 2.144%
90.0% Δp: 0.862%
75.0% Δp: 0.043%
Median Δp: -0.000%
25.0% Δp: -0.097%
10.0% Δp: -1.173%
5.0% Δp: -2.602%
1.0% Δp: -6.889%
0.1% Δp: -17.803%
Minimum Δp: -88.628%
RMS Δp : 2.229 ± 0.037 %
Same top p: 96.672 ± 0.047 %