eaddario commited on
Commit
2c7e1e2
·
verified ·
1 Parent(s): de75350

Generate Perplexity, KLD, ARC, HellaSwag, MMLU, Truthful QA and WinoGrande scores

Browse files
Files changed (42) hide show
  1. scores/gemma-4-E4B-it-q2_k.arc +23 -0
  2. scores/gemma-4-E4B-it-q2_k.hsw +22 -0
  3. scores/gemma-4-E4B-it-q2_k.mmlu +23 -0
  4. scores/gemma-4-E4B-it-q2_k.ppx +56 -0
  5. scores/gemma-4-E4B-it-q2_k.tqa +23 -0
  6. scores/gemma-4-E4B-it-q2_k.wng +21 -0
  7. scores/gemma-4-E4B-it-q3_k.arc +23 -0
  8. scores/gemma-4-E4B-it-q3_k.hsw +22 -0
  9. scores/gemma-4-E4B-it-q3_k.mmlu +23 -0
  10. scores/gemma-4-E4B-it-q3_k.ppx +56 -0
  11. scores/gemma-4-E4B-it-q3_k.tqa +23 -0
  12. scores/gemma-4-E4B-it-q3_k.wng +21 -0
  13. scores/gemma-4-E4B-it-q4_k.arc +21 -0
  14. scores/gemma-4-E4B-it-q4_k.hsw +20 -0
  15. scores/gemma-4-E4B-it-q4_k.mmlu +21 -0
  16. scores/gemma-4-E4B-it-q4_k.ppx +54 -0
  17. scores/gemma-4-E4B-it-q4_k.tqa +21 -0
  18. scores/gemma-4-E4B-it-q4_k.wng +19 -0
  19. scores/gemma-4-E4B-it-q5_k.arc +18 -0
  20. scores/gemma-4-E4B-it-q5_k.hsw +17 -0
  21. scores/gemma-4-E4B-it-q5_k.mmlu +18 -0
  22. scores/gemma-4-E4B-it-q5_k.ppx +51 -0
  23. scores/gemma-4-E4B-it-q5_k.tqa +18 -0
  24. scores/gemma-4-E4B-it-q5_k.wng +16 -0
  25. scores/gemma-4-E4B-it-q6_k.arc +17 -0
  26. scores/gemma-4-E4B-it-q6_k.hsw +16 -0
  27. scores/gemma-4-E4B-it-q6_k.mmlu +17 -0
  28. scores/gemma-4-E4B-it-q6_k.ppx +50 -0
  29. scores/gemma-4-E4B-it-q6_k.tqa +17 -0
  30. scores/gemma-4-E4B-it-q6_k.wng +15 -0
  31. scores/gemma-4-E4B-it-q7_k.arc +16 -0
  32. scores/gemma-4-E4B-it-q7_k.hsw +15 -0
  33. scores/gemma-4-E4B-it-q7_k.mmlu +16 -0
  34. scores/gemma-4-E4B-it-q7_k.ppx +49 -0
  35. scores/gemma-4-E4B-it-q7_k.tqa +16 -0
  36. scores/gemma-4-E4B-it-q7_k.wng +14 -0
  37. scores/gemma-4-E4B-it-q8_0.arc +15 -0
  38. scores/gemma-4-E4B-it-q8_0.hsw +14 -0
  39. scores/gemma-4-E4B-it-q8_0.mmlu +15 -0
  40. scores/gemma-4-E4B-it-q8_0.ppx +48 -0
  41. scores/gemma-4-E4B-it-q8_0.tqa +15 -0
  42. scores/gemma-4-E4B-it-q8_0.wng +13 -0
scores/gemma-4-E4B-it-q2_k.arc ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 7 tensors
5
+ llama_model_loader: - type q2_K: 112 tensors
6
+ llama_model_loader: - type q3_K: 36 tensors
7
+ llama_model_loader: - type q4_K: 15 tensors
8
+ llama_model_loader: - type q5_K: 2 tensors
9
+ llama_model_loader: - type iq2_xxs: 94 tensors
10
+ llama_model_loader: - type iq2_xs: 38 tensors
11
+ llama_model_loader: - type iq3_xxs: 38 tensors
12
+ llama_model_loader: - type iq4_xs: 2 tensors
13
+ llama_model_loader: - type iq1_m: 36 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ2_S - 2.5 bpw
16
+ print_info: file size = 2.19 GiB (2.50 BPW)
17
+
18
+ multiple_choice_score: there are 869 tasks in prompt
19
+ multiple_choice_score: selecting 750 random tasks from 869 tasks available
20
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
21
+
22
+ Final result: 34.8000 +/- 1.7405
23
+ Random chance: 25.0083 +/- 1.5824
scores/gemma-4-E4B-it-q2_k.hsw ADDED
@@ -0,0 +1,22 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 7 tensors
5
+ llama_model_loader: - type q2_K: 112 tensors
6
+ llama_model_loader: - type q3_K: 36 tensors
7
+ llama_model_loader: - type q4_K: 15 tensors
8
+ llama_model_loader: - type q5_K: 2 tensors
9
+ llama_model_loader: - type iq2_xxs: 94 tensors
10
+ llama_model_loader: - type iq2_xs: 38 tensors
11
+ llama_model_loader: - type iq3_xxs: 38 tensors
12
+ llama_model_loader: - type iq4_xs: 2 tensors
13
+ llama_model_loader: - type iq1_m: 36 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ2_S - 2.5 bpw
16
+ print_info: file size = 2.19 GiB (2.50 BPW)
17
+
18
+ hellaswag_score : loaded 10042 tasks from prompt.
19
+ hellaswag_score : selecting 750 randomized tasks.
20
+ hellaswag_score : calculating hellaswag score over selected tasks.
21
+
22
+ 750 42.53333333% [39.0419%, 46.1008%]
scores/gemma-4-E4B-it-q2_k.mmlu ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 7 tensors
5
+ llama_model_loader: - type q2_K: 112 tensors
6
+ llama_model_loader: - type q3_K: 36 tensors
7
+ llama_model_loader: - type q4_K: 15 tensors
8
+ llama_model_loader: - type q5_K: 2 tensors
9
+ llama_model_loader: - type iq2_xxs: 94 tensors
10
+ llama_model_loader: - type iq2_xs: 38 tensors
11
+ llama_model_loader: - type iq3_xxs: 38 tensors
12
+ llama_model_loader: - type iq4_xs: 2 tensors
13
+ llama_model_loader: - type iq1_m: 36 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ2_S - 2.5 bpw
16
+ print_info: file size = 2.19 GiB (2.50 BPW)
17
+
18
+ multiple_choice_score: there are 5362 tasks in prompt
19
+ multiple_choice_score: selecting 750 random tasks from 5362 tasks available
20
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
21
+
22
+ Final result: 34.1333 +/- 1.7325
23
+ Random chance: 25.0000 +/- 1.5822
scores/gemma-4-E4B-it-q2_k.ppx ADDED
@@ -0,0 +1,56 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 7 tensors
5
+ llama_model_loader: - type q2_K: 112 tensors
6
+ llama_model_loader: - type q3_K: 36 tensors
7
+ llama_model_loader: - type q4_K: 15 tensors
8
+ llama_model_loader: - type q5_K: 2 tensors
9
+ llama_model_loader: - type iq2_xxs: 94 tensors
10
+ llama_model_loader: - type iq2_xs: 38 tensors
11
+ llama_model_loader: - type iq3_xxs: 38 tensors
12
+ llama_model_loader: - type iq4_xs: 2 tensors
13
+ llama_model_loader: - type iq1_m: 36 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ2_S - 2.5 bpw
16
+ print_info: file size = 2.19 GiB (2.50 BPW)
17
+
18
+ ====== Perplexity statistics ======
19
+ Mean PPL(Q) : 158.513459 ± 1.991659
20
+ Mean PPL(base) : 52.693235 ± 0.610088
21
+ Cor(ln(PPL(Q)), ln(PPL(base))): 70.11%
22
+ Mean ln(PPL(Q)/PPL(base)) : 1.101352 ± 0.009377
23
+ Mean PPL(Q)/PPL(base) : 3.008232 ± 0.028209
24
+ Mean PPL(Q)-PPL(base) : 105.820225 ± 1.623290
25
+
26
+ ====== KL divergence statistics ======
27
+ Mean KLD: 2.371872 ± 0.006399
28
+ Maximum KLD: 30.074741
29
+ 99.9% KLD: 16.281898
30
+ 99.0% KLD: 10.876118
31
+ 95.0% KLD: 7.153347
32
+ 90.0% KLD: 5.582164
33
+ Median KLD: 1.691821
34
+ 10.0% KLD: 0.054692
35
+ 5.0% KLD: 0.010447
36
+ 1.0% KLD: 0.000600
37
+ 0.1% KLD: 0.000037
38
+ Minimum KLD: 0.000000
39
+
40
+ ====== Token probability statistics ======
41
+ Mean Δp: -13.185 ± 0.082 %
42
+ Maximum Δp: 99.835%
43
+ 99.9% Δp: 89.775%
44
+ 99.0% Δp: 59.588%
45
+ 95.0% Δp: 19.010%
46
+ 90.0% Δp: 4.926%
47
+ 75.0% Δp: 0.030%
48
+ Median Δp: -0.543%
49
+ 25.0% Δp: -18.065%
50
+ 10.0% Δp: -66.818%
51
+ 5.0% Δp: -88.176%
52
+ 1.0% Δp: -99.296%
53
+ 0.1% Δp: -99.987%
54
+ Minimum Δp: -100.000%
55
+ RMS Δp : 33.940 ± 0.093 %
56
+ Same top p: 44.998 ± 0.130 %
scores/gemma-4-E4B-it-q2_k.tqa ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 7 tensors
5
+ llama_model_loader: - type q2_K: 112 tensors
6
+ llama_model_loader: - type q3_K: 36 tensors
7
+ llama_model_loader: - type q4_K: 15 tensors
8
+ llama_model_loader: - type q5_K: 2 tensors
9
+ llama_model_loader: - type iq2_xxs: 94 tensors
10
+ llama_model_loader: - type iq2_xs: 38 tensors
11
+ llama_model_loader: - type iq3_xxs: 38 tensors
12
+ llama_model_loader: - type iq4_xs: 2 tensors
13
+ llama_model_loader: - type iq1_m: 36 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ2_S - 2.5 bpw
16
+ print_info: file size = 2.19 GiB (2.50 BPW)
17
+
18
+ multiple_choice_score: there are 817 tasks in prompt
19
+ multiple_choice_score: selecting 750 random tasks from 817 tasks available
20
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
21
+
22
+ Final result: 28.1333 +/- 1.6430
23
+ Random chance: 19.8992 +/- 1.4588
scores/gemma-4-E4B-it-q2_k.wng ADDED
@@ -0,0 +1,21 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 7 tensors
5
+ llama_model_loader: - type q2_K: 112 tensors
6
+ llama_model_loader: - type q3_K: 36 tensors
7
+ llama_model_loader: - type q4_K: 15 tensors
8
+ llama_model_loader: - type q5_K: 2 tensors
9
+ llama_model_loader: - type iq2_xxs: 94 tensors
10
+ llama_model_loader: - type iq2_xs: 38 tensors
11
+ llama_model_loader: - type iq3_xxs: 38 tensors
12
+ llama_model_loader: - type iq4_xs: 2 tensors
13
+ llama_model_loader: - type iq1_m: 36 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ2_S - 2.5 bpw
16
+ print_info: file size = 2.19 GiB (2.50 BPW)
17
+
18
+ winogrande_score : loaded 1267 tasks from prompt.
19
+ winogrande_score : selecting 750 random tasks
20
+
21
+ Final Winogrande score(750 tasks): 51.8667 +/- 1.8257
scores/gemma-4-E4B-it-q3_k.arc ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 11 tensors
5
+ llama_model_loader: - type q5_1: 6 tensors
6
+ llama_model_loader: - type q8_0: 1 tensors
7
+ llama_model_loader: - type q2_K: 11 tensors
8
+ llama_model_loader: - type q3_K: 118 tensors
9
+ llama_model_loader: - type q4_K: 41 tensors
10
+ llama_model_loader: - type q5_K: 6 tensors
11
+ llama_model_loader: - type iq3_xxs: 41 tensors
12
+ llama_model_loader: - type iq3_s: 49 tensors
13
+ llama_model_loader: - type iq4_xs: 96 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ4_XS - 4.25 bpw
16
+ print_info: file size = 3.06 GiB (3.50 BPW)
17
+
18
+ multiple_choice_score: there are 869 tasks in prompt
19
+ multiple_choice_score: selecting 750 random tasks from 869 tasks available
20
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
21
+
22
+ Final result: 54.0000 +/- 1.8211
23
+ Random chance: 25.0083 +/- 1.5824
scores/gemma-4-E4B-it-q3_k.hsw ADDED
@@ -0,0 +1,22 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 11 tensors
5
+ llama_model_loader: - type q5_1: 6 tensors
6
+ llama_model_loader: - type q8_0: 1 tensors
7
+ llama_model_loader: - type q2_K: 11 tensors
8
+ llama_model_loader: - type q3_K: 118 tensors
9
+ llama_model_loader: - type q4_K: 41 tensors
10
+ llama_model_loader: - type q5_K: 6 tensors
11
+ llama_model_loader: - type iq3_xxs: 41 tensors
12
+ llama_model_loader: - type iq3_s: 49 tensors
13
+ llama_model_loader: - type iq4_xs: 96 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ4_XS - 4.25 bpw
16
+ print_info: file size = 3.06 GiB (3.50 BPW)
17
+
18
+ hellaswag_score : loaded 10042 tasks from prompt.
19
+ hellaswag_score : selecting 750 randomized tasks.
20
+ hellaswag_score : calculating hellaswag score over selected tasks.
21
+
22
+ 750 61.46666667% [57.9336%, 64.8829%]
scores/gemma-4-E4B-it-q3_k.mmlu ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 11 tensors
5
+ llama_model_loader: - type q5_1: 6 tensors
6
+ llama_model_loader: - type q8_0: 1 tensors
7
+ llama_model_loader: - type q2_K: 11 tensors
8
+ llama_model_loader: - type q3_K: 118 tensors
9
+ llama_model_loader: - type q4_K: 41 tensors
10
+ llama_model_loader: - type q5_K: 6 tensors
11
+ llama_model_loader: - type iq3_xxs: 41 tensors
12
+ llama_model_loader: - type iq3_s: 49 tensors
13
+ llama_model_loader: - type iq4_xs: 96 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ4_XS - 4.25 bpw
16
+ print_info: file size = 3.06 GiB (3.50 BPW)
17
+
18
+ multiple_choice_score: there are 5362 tasks in prompt
19
+ multiple_choice_score: selecting 750 random tasks from 5362 tasks available
20
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
21
+
22
+ Final result: 64.6667 +/- 1.7466
23
+ Random chance: 25.0000 +/- 1.5822
scores/gemma-4-E4B-it-q3_k.ppx ADDED
@@ -0,0 +1,56 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 11 tensors
5
+ llama_model_loader: - type q5_1: 6 tensors
6
+ llama_model_loader: - type q8_0: 1 tensors
7
+ llama_model_loader: - type q2_K: 11 tensors
8
+ llama_model_loader: - type q3_K: 118 tensors
9
+ llama_model_loader: - type q4_K: 41 tensors
10
+ llama_model_loader: - type q5_K: 6 tensors
11
+ llama_model_loader: - type iq3_xxs: 41 tensors
12
+ llama_model_loader: - type iq3_s: 49 tensors
13
+ llama_model_loader: - type iq4_xs: 96 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ4_XS - 4.25 bpw
16
+ print_info: file size = 3.06 GiB (3.50 BPW)
17
+
18
+ ====== Perplexity statistics ======
19
+ Mean PPL(Q) : 53.460778 ± 0.637355
20
+ Mean PPL(base) : 52.693235 ± 0.610088
21
+ Cor(ln(PPL(Q)), ln(PPL(base))): 93.43%
22
+ Mean ln(PPL(Q)/PPL(base)) : 0.014461 ± 0.004273
23
+ Mean PPL(Q)/PPL(base) : 1.014566 ± 0.004336
24
+ Mean PPL(Q)-PPL(base) : 0.767544 ± 0.227712
25
+
26
+ ====== KL divergence statistics ======
27
+ Mean KLD: 0.368276 ± 0.001632
28
+ Maximum KLD: 16.233898
29
+ 99.9% KLD: 6.639840
30
+ 99.0% KLD: 2.925996
31
+ 95.0% KLD: 1.350669
32
+ 90.0% KLD: 0.914818
33
+ Median KLD: 0.166417
34
+ 10.0% KLD: 0.001494
35
+ 5.0% KLD: 0.000202
36
+ 1.0% KLD: 0.000008
37
+ 0.1% KLD: 0.000000
38
+ Minimum KLD: -0.000030
39
+
40
+ ====== Token probability statistics ======
41
+ Mean Δp: -1.997 ± 0.038 %
42
+ Maximum Δp: 99.669%
43
+ 99.9% Δp: 75.373%
44
+ 99.0% Δp: 40.206%
45
+ 95.0% Δp: 14.981%
46
+ 90.0% Δp: 6.041%
47
+ 75.0% Δp: 0.341%
48
+ Median Δp: -0.002%
49
+ 25.0% Δp: -1.599%
50
+ 10.0% Δp: -13.659%
51
+ 5.0% Δp: -27.491%
52
+ 1.0% Δp: -61.928%
53
+ 0.1% Δp: -94.101%
54
+ Minimum Δp: -99.998%
55
+ RMS Δp : 14.827 ± 0.072 %
56
+ Same top p: 75.953 ± 0.111 %
scores/gemma-4-E4B-it-q3_k.tqa ADDED
@@ -0,0 +1,23 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 11 tensors
5
+ llama_model_loader: - type q5_1: 6 tensors
6
+ llama_model_loader: - type q8_0: 1 tensors
7
+ llama_model_loader: - type q2_K: 11 tensors
8
+ llama_model_loader: - type q3_K: 118 tensors
9
+ llama_model_loader: - type q4_K: 41 tensors
10
+ llama_model_loader: - type q5_K: 6 tensors
11
+ llama_model_loader: - type iq3_xxs: 41 tensors
12
+ llama_model_loader: - type iq3_s: 49 tensors
13
+ llama_model_loader: - type iq4_xs: 96 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ4_XS - 4.25 bpw
16
+ print_info: file size = 3.06 GiB (3.50 BPW)
17
+
18
+ multiple_choice_score: there are 817 tasks in prompt
19
+ multiple_choice_score: selecting 750 random tasks from 817 tasks available
20
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
21
+
22
+ Final result: 33.3333 +/- 1.7225
23
+ Random chance: 19.8992 +/- 1.4588
scores/gemma-4-E4B-it-q3_k.wng ADDED
@@ -0,0 +1,21 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 1 tensors
4
+ llama_model_loader: - type q4_1: 11 tensors
5
+ llama_model_loader: - type q5_1: 6 tensors
6
+ llama_model_loader: - type q8_0: 1 tensors
7
+ llama_model_loader: - type q2_K: 11 tensors
8
+ llama_model_loader: - type q3_K: 118 tensors
9
+ llama_model_loader: - type q4_K: 41 tensors
10
+ llama_model_loader: - type q5_K: 6 tensors
11
+ llama_model_loader: - type iq3_xxs: 41 tensors
12
+ llama_model_loader: - type iq3_s: 49 tensors
13
+ llama_model_loader: - type iq4_xs: 96 tensors
14
+ print_info: file format = GGUF V3 (latest)
15
+ print_info: file type = IQ4_XS - 4.25 bpw
16
+ print_info: file size = 3.06 GiB (3.50 BPW)
17
+
18
+ winogrande_score : loaded 1267 tasks from prompt.
19
+ winogrande_score : selecting 750 random tasks
20
+
21
+ Final Winogrande score(750 tasks): 66.6667 +/- 1.7225
scores/gemma-4-E4B-it-q4_k.arc ADDED
@@ -0,0 +1,21 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 2 tensors
4
+ llama_model_loader: - type q4_1: 5 tensors
5
+ llama_model_loader: - type q5_1: 24 tensors
6
+ llama_model_loader: - type q8_0: 2 tensors
7
+ llama_model_loader: - type q3_K: 1 tensors
8
+ llama_model_loader: - type q4_K: 95 tensors
9
+ llama_model_loader: - type q5_K: 101 tensors
10
+ llama_model_loader: - type q6_K: 2 tensors
11
+ llama_model_loader: - type iq4_xs: 149 tensors
12
+ print_info: file format = GGUF V3 (latest)
13
+ print_info: file type = Q4_K - Medium
14
+ print_info: file size = 3.94 GiB (4.50 BPW)
15
+
16
+ multiple_choice_score: there are 869 tasks in prompt
17
+ multiple_choice_score: selecting 750 random tasks from 869 tasks available
18
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
19
+
20
+ Final result: 58.1333 +/- 1.8026
21
+ Random chance: 25.0083 +/- 1.5824
scores/gemma-4-E4B-it-q4_k.hsw ADDED
@@ -0,0 +1,20 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 2 tensors
4
+ llama_model_loader: - type q4_1: 5 tensors
5
+ llama_model_loader: - type q5_1: 24 tensors
6
+ llama_model_loader: - type q8_0: 2 tensors
7
+ llama_model_loader: - type q3_K: 1 tensors
8
+ llama_model_loader: - type q4_K: 95 tensors
9
+ llama_model_loader: - type q5_K: 101 tensors
10
+ llama_model_loader: - type q6_K: 2 tensors
11
+ llama_model_loader: - type iq4_xs: 149 tensors
12
+ print_info: file format = GGUF V3 (latest)
13
+ print_info: file type = Q4_K - Medium
14
+ print_info: file size = 3.94 GiB (4.50 BPW)
15
+
16
+ hellaswag_score : loaded 10042 tasks from prompt.
17
+ hellaswag_score : selecting 750 randomized tasks.
18
+ hellaswag_score : calculating hellaswag score over selected tasks.
19
+
20
+ 750 66.66666667% [63.2155%, 69.9479%]
scores/gemma-4-E4B-it-q4_k.mmlu ADDED
@@ -0,0 +1,21 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 2 tensors
4
+ llama_model_loader: - type q4_1: 5 tensors
5
+ llama_model_loader: - type q5_1: 24 tensors
6
+ llama_model_loader: - type q8_0: 2 tensors
7
+ llama_model_loader: - type q3_K: 1 tensors
8
+ llama_model_loader: - type q4_K: 95 tensors
9
+ llama_model_loader: - type q5_K: 101 tensors
10
+ llama_model_loader: - type q6_K: 2 tensors
11
+ llama_model_loader: - type iq4_xs: 149 tensors
12
+ print_info: file format = GGUF V3 (latest)
13
+ print_info: file type = Q4_K - Medium
14
+ print_info: file size = 3.94 GiB (4.50 BPW)
15
+
16
+ multiple_choice_score: there are 5362 tasks in prompt
17
+ multiple_choice_score: selecting 750 random tasks from 5362 tasks available
18
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
19
+
20
+ Final result: 66.2667 +/- 1.7276
21
+ Random chance: 25.0000 +/- 1.5822
scores/gemma-4-E4B-it-q4_k.ppx ADDED
@@ -0,0 +1,54 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 2 tensors
4
+ llama_model_loader: - type q4_1: 5 tensors
5
+ llama_model_loader: - type q5_1: 24 tensors
6
+ llama_model_loader: - type q8_0: 2 tensors
7
+ llama_model_loader: - type q3_K: 1 tensors
8
+ llama_model_loader: - type q4_K: 95 tensors
9
+ llama_model_loader: - type q5_K: 101 tensors
10
+ llama_model_loader: - type q6_K: 2 tensors
11
+ llama_model_loader: - type iq4_xs: 149 tensors
12
+ print_info: file format = GGUF V3 (latest)
13
+ print_info: file type = Q4_K - Medium
14
+ print_info: file size = 3.94 GiB (4.50 BPW)
15
+
16
+ ====== Perplexity statistics ======
17
+ Mean PPL(Q) : 56.460364 ± 0.691942
18
+ Mean PPL(base) : 52.693235 ± 0.610088
19
+ Cor(ln(PPL(Q)), ln(PPL(base))): 97.35%
20
+ Mean ln(PPL(Q)/PPL(base)) : 0.069052 ± 0.002823
21
+ Mean PPL(Q)/PPL(base) : 1.071492 ± 0.003025
22
+ Mean PPL(Q)-PPL(base) : 3.767129 ± 0.170411
23
+
24
+ ====== KL divergence statistics ======
25
+ Mean KLD: 0.095300 ± 0.000557
26
+ Maximum KLD: 15.853424
27
+ 99.9% KLD: 2.527996
28
+ 99.0% KLD: 0.863295
29
+ 95.0% KLD: 0.356812
30
+ 90.0% KLD: 0.229792
31
+ Median KLD: 0.035697
32
+ 10.0% KLD: 0.000216
33
+ 5.0% KLD: 0.000025
34
+ 1.0% KLD: 0.000001
35
+ 0.1% KLD: -0.000001
36
+ Minimum KLD: -0.000043
37
+
38
+ ====== Token probability statistics ======
39
+ Mean Δp: -0.421 ± 0.020 %
40
+ Maximum Δp: 99.633%
41
+ 99.9% Δp: 54.652%
42
+ 99.0% Δp: 23.879%
43
+ 95.0% Δp: 8.503%
44
+ 90.0% Δp: 3.458%
45
+ 75.0% Δp: 0.202%
46
+ Median Δp: -0.000%
47
+ 25.0% Δp: -0.392%
48
+ 10.0% Δp: -5.060%
49
+ 5.0% Δp: -11.030%
50
+ 1.0% Δp: -29.030%
51
+ 0.1% Δp: -62.118%
52
+ Minimum Δp: -98.611%
53
+ RMS Δp : 7.866 ± 0.054 %
54
+ Same top p: 87.367 ± 0.087 %
scores/gemma-4-E4B-it-q4_k.tqa ADDED
@@ -0,0 +1,21 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 2 tensors
4
+ llama_model_loader: - type q4_1: 5 tensors
5
+ llama_model_loader: - type q5_1: 24 tensors
6
+ llama_model_loader: - type q8_0: 2 tensors
7
+ llama_model_loader: - type q3_K: 1 tensors
8
+ llama_model_loader: - type q4_K: 95 tensors
9
+ llama_model_loader: - type q5_K: 101 tensors
10
+ llama_model_loader: - type q6_K: 2 tensors
11
+ llama_model_loader: - type iq4_xs: 149 tensors
12
+ print_info: file format = GGUF V3 (latest)
13
+ print_info: file type = Q4_K - Medium
14
+ print_info: file size = 3.94 GiB (4.50 BPW)
15
+
16
+ multiple_choice_score: there are 817 tasks in prompt
17
+ multiple_choice_score: selecting 750 random tasks from 817 tasks available
18
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
19
+
20
+ Final result: 32.5333 +/- 1.7119
21
+ Random chance: 19.8992 +/- 1.4588
scores/gemma-4-E4B-it-q4_k.wng ADDED
@@ -0,0 +1,19 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 2 tensors
4
+ llama_model_loader: - type q4_1: 5 tensors
5
+ llama_model_loader: - type q5_1: 24 tensors
6
+ llama_model_loader: - type q8_0: 2 tensors
7
+ llama_model_loader: - type q3_K: 1 tensors
8
+ llama_model_loader: - type q4_K: 95 tensors
9
+ llama_model_loader: - type q5_K: 101 tensors
10
+ llama_model_loader: - type q6_K: 2 tensors
11
+ llama_model_loader: - type iq4_xs: 149 tensors
12
+ print_info: file format = GGUF V3 (latest)
13
+ print_info: file type = Q4_K - Medium
14
+ print_info: file size = 3.94 GiB (4.50 BPW)
15
+
16
+ winogrande_score : loaded 1267 tasks from prompt.
17
+ winogrande_score : selecting 750 random tasks
18
+
19
+ Final Winogrande score(750 tasks): 65.4667 +/- 1.7374
scores/gemma-4-E4B-it-q5_k.arc ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 13 tensors
4
+ llama_model_loader: - type q5_1: 28 tensors
5
+ llama_model_loader: - type q8_0: 6 tensors
6
+ llama_model_loader: - type q4_K: 3 tensors
7
+ llama_model_loader: - type q5_K: 158 tensors
8
+ llama_model_loader: - type q6_K: 173 tensors
9
+ print_info: file format = GGUF V3 (latest)
10
+ print_info: file type = Q5_K - Medium
11
+ print_info: file size = 4.81 GiB (5.50 BPW)
12
+
13
+ multiple_choice_score: there are 869 tasks in prompt
14
+ multiple_choice_score: selecting 750 random tasks from 869 tasks available
15
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
16
+
17
+ Final result: 57.4667 +/- 1.8065
18
+ Random chance: 25.0083 +/- 1.5824
scores/gemma-4-E4B-it-q5_k.hsw ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 13 tensors
4
+ llama_model_loader: - type q5_1: 28 tensors
5
+ llama_model_loader: - type q8_0: 6 tensors
6
+ llama_model_loader: - type q4_K: 3 tensors
7
+ llama_model_loader: - type q5_K: 158 tensors
8
+ llama_model_loader: - type q6_K: 173 tensors
9
+ print_info: file format = GGUF V3 (latest)
10
+ print_info: file type = Q5_K - Medium
11
+ print_info: file size = 4.81 GiB (5.50 BPW)
12
+
13
+ hellaswag_score : loaded 10042 tasks from prompt.
14
+ hellaswag_score : selecting 750 randomized tasks.
15
+ hellaswag_score : calculating hellaswag score over selected tasks.
16
+
17
+ 750 68.13333333% [64.7134%, 71.3685%]
scores/gemma-4-E4B-it-q5_k.mmlu ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 13 tensors
4
+ llama_model_loader: - type q5_1: 28 tensors
5
+ llama_model_loader: - type q8_0: 6 tensors
6
+ llama_model_loader: - type q4_K: 3 tensors
7
+ llama_model_loader: - type q5_K: 158 tensors
8
+ llama_model_loader: - type q6_K: 173 tensors
9
+ print_info: file format = GGUF V3 (latest)
10
+ print_info: file type = Q5_K - Medium
11
+ print_info: file size = 4.81 GiB (5.50 BPW)
12
+
13
+ multiple_choice_score: there are 5362 tasks in prompt
14
+ multiple_choice_score: selecting 750 random tasks from 5362 tasks available
15
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
16
+
17
+ Final result: 67.4667 +/- 1.7119
18
+ Random chance: 25.0000 +/- 1.5822
scores/gemma-4-E4B-it-q5_k.ppx ADDED
@@ -0,0 +1,51 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 13 tensors
4
+ llama_model_loader: - type q5_1: 28 tensors
5
+ llama_model_loader: - type q8_0: 6 tensors
6
+ llama_model_loader: - type q4_K: 3 tensors
7
+ llama_model_loader: - type q5_K: 158 tensors
8
+ llama_model_loader: - type q6_K: 173 tensors
9
+ print_info: file format = GGUF V3 (latest)
10
+ print_info: file type = Q5_K - Medium
11
+ print_info: file size = 4.81 GiB (5.50 BPW)
12
+
13
+ ====== Perplexity statistics ======
14
+ Mean PPL(Q) : 58.576787 ± 0.727545
15
+ Mean PPL(base) : 52.693235 ± 0.610088
16
+ Cor(ln(PPL(Q)), ln(PPL(base))): 98.32%
17
+ Mean ln(PPL(Q)/PPL(base)) : 0.105851 ± 0.002352
18
+ Mean PPL(Q)/PPL(base) : 1.111657 ± 0.002615
19
+ Mean PPL(Q)-PPL(base) : 5.883553 ± 0.169353
20
+
21
+ ====== KL divergence statistics ======
22
+ Mean KLD: 0.021173 ± 0.000200
23
+ Maximum KLD: 8.555525
24
+ 99.9% KLD: 0.762584
25
+ 99.0% KLD: 0.206188
26
+ 95.0% KLD: 0.075586
27
+ 90.0% KLD: 0.047285
28
+ Median KLD: 0.007055
29
+ 10.0% KLD: 0.000044
30
+ 5.0% KLD: 0.000005
31
+ 1.0% KLD: -0.000000
32
+ 0.1% KLD: -0.000002
33
+ Minimum KLD: -0.000057
34
+
35
+ ====== Token probability statistics ======
36
+ Mean Δp: -0.211 ± 0.010 %
37
+ Maximum Δp: 95.665%
38
+ 99.9% Δp: 29.084%
39
+ 99.0% Δp: 10.904%
40
+ 95.0% Δp: 3.685%
41
+ 90.0% Δp: 1.450%
42
+ 75.0% Δp: 0.063%
43
+ Median Δp: -0.000%
44
+ 25.0% Δp: -0.216%
45
+ 10.0% Δp: -2.289%
46
+ 5.0% Δp: -4.984%
47
+ 1.0% Δp: -12.990%
48
+ 0.1% Δp: -30.230%
49
+ Minimum Δp: -92.949%
50
+ RMS Δp : 3.844 ± 0.042 %
51
+ Same top p: 94.144 ± 0.061 %
scores/gemma-4-E4B-it-q5_k.tqa ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 13 tensors
4
+ llama_model_loader: - type q5_1: 28 tensors
5
+ llama_model_loader: - type q8_0: 6 tensors
6
+ llama_model_loader: - type q4_K: 3 tensors
7
+ llama_model_loader: - type q5_K: 158 tensors
8
+ llama_model_loader: - type q6_K: 173 tensors
9
+ print_info: file format = GGUF V3 (latest)
10
+ print_info: file type = Q5_K - Medium
11
+ print_info: file size = 4.81 GiB (5.50 BPW)
12
+
13
+ multiple_choice_score: there are 817 tasks in prompt
14
+ multiple_choice_score: selecting 750 random tasks from 817 tasks available
15
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
16
+
17
+ Final result: 34.2667 +/- 1.7342
18
+ Random chance: 19.8992 +/- 1.4588
scores/gemma-4-E4B-it-q5_k.wng ADDED
@@ -0,0 +1,16 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 13 tensors
4
+ llama_model_loader: - type q5_1: 28 tensors
5
+ llama_model_loader: - type q8_0: 6 tensors
6
+ llama_model_loader: - type q4_K: 3 tensors
7
+ llama_model_loader: - type q5_K: 158 tensors
8
+ llama_model_loader: - type q6_K: 173 tensors
9
+ print_info: file format = GGUF V3 (latest)
10
+ print_info: file type = Q5_K - Medium
11
+ print_info: file size = 4.81 GiB (5.50 BPW)
12
+
13
+ winogrande_score : loaded 1267 tasks from prompt.
14
+ winogrande_score : selecting 750 random tasks
15
+
16
+ Final Winogrande score(750 tasks): 67.3333 +/- 1.7137
scores/gemma-4-E4B-it-q6_k.arc ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 32 tensors
4
+ llama_model_loader: - type q5_1: 8 tensors
5
+ llama_model_loader: - type q8_0: 91 tensors
6
+ llama_model_loader: - type q5_K: 2 tensors
7
+ llama_model_loader: - type q6_K: 248 tensors
8
+ print_info: file format = GGUF V3 (latest)
9
+ print_info: file type = Q6_K
10
+ print_info: file size = 5.69 GiB (6.50 BPW)
11
+
12
+ multiple_choice_score: there are 869 tasks in prompt
13
+ multiple_choice_score: selecting 750 random tasks from 869 tasks available
14
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
15
+
16
+ Final result: 57.4667 +/- 1.8065
17
+ Random chance: 25.0083 +/- 1.5824
scores/gemma-4-E4B-it-q6_k.hsw ADDED
@@ -0,0 +1,16 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 32 tensors
4
+ llama_model_loader: - type q5_1: 8 tensors
5
+ llama_model_loader: - type q8_0: 91 tensors
6
+ llama_model_loader: - type q5_K: 2 tensors
7
+ llama_model_loader: - type q6_K: 248 tensors
8
+ print_info: file format = GGUF V3 (latest)
9
+ print_info: file type = Q6_K
10
+ print_info: file size = 5.69 GiB (6.50 BPW)
11
+
12
+ hellaswag_score : loaded 10042 tasks from prompt.
13
+ hellaswag_score : selecting 750 randomized tasks.
14
+ hellaswag_score : calculating hellaswag score over selected tasks.
15
+
16
+ 750 68.66666667% [65.2590%, 71.8841%]
scores/gemma-4-E4B-it-q6_k.mmlu ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 32 tensors
4
+ llama_model_loader: - type q5_1: 8 tensors
5
+ llama_model_loader: - type q8_0: 91 tensors
6
+ llama_model_loader: - type q5_K: 2 tensors
7
+ llama_model_loader: - type q6_K: 248 tensors
8
+ print_info: file format = GGUF V3 (latest)
9
+ print_info: file type = Q6_K
10
+ print_info: file size = 5.69 GiB (6.50 BPW)
11
+
12
+ multiple_choice_score: there are 5362 tasks in prompt
13
+ multiple_choice_score: selecting 750 random tasks from 5362 tasks available
14
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
15
+
16
+ Final result: 66.2667 +/- 1.7276
17
+ Random chance: 25.0000 +/- 1.5822
scores/gemma-4-E4B-it-q6_k.ppx ADDED
@@ -0,0 +1,50 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 32 tensors
4
+ llama_model_loader: - type q5_1: 8 tensors
5
+ llama_model_loader: - type q8_0: 91 tensors
6
+ llama_model_loader: - type q5_K: 2 tensors
7
+ llama_model_loader: - type q6_K: 248 tensors
8
+ print_info: file format = GGUF V3 (latest)
9
+ print_info: file type = Q6_K
10
+ print_info: file size = 5.69 GiB (6.50 BPW)
11
+
12
+ ====== Perplexity statistics ======
13
+ Mean PPL(Q) : 57.395025 ± 0.709393
14
+ Mean PPL(base) : 52.693235 ± 0.610088
15
+ Cor(ln(PPL(Q)), ln(PPL(base))): 98.51%
16
+ Mean ln(PPL(Q)/PPL(base)) : 0.085471 ± 0.002205
17
+ Mean PPL(Q)/PPL(base) : 1.089229 ± 0.002402
18
+ Mean PPL(Q)-PPL(base) : 4.701791 ± 0.150722
19
+
20
+ ====== KL divergence statistics ======
21
+ Mean KLD: 0.006872 ± 0.000100
22
+ Maximum KLD: 3.890319
23
+ 99.9% KLD: 0.332454
24
+ 99.0% KLD: 0.064667
25
+ 95.0% KLD: 0.022811
26
+ 90.0% KLD: 0.013986
27
+ Median KLD: 0.002055
28
+ 10.0% KLD: 0.000015
29
+ 5.0% KLD: 0.000002
30
+ 1.0% KLD: -0.000000
31
+ 0.1% KLD: -0.000002
32
+ Minimum KLD: -0.000105
33
+
34
+ ====== Token probability statistics ======
35
+ Mean Δp: -0.077 ± 0.006 %
36
+ Maximum Δp: 75.114%
37
+ 99.9% Δp: 15.320%
38
+ 99.0% Δp: 6.360%
39
+ 95.0% Δp: 2.144%
40
+ 90.0% Δp: 0.862%
41
+ 75.0% Δp: 0.043%
42
+ Median Δp: -0.000%
43
+ 25.0% Δp: -0.097%
44
+ 10.0% Δp: -1.173%
45
+ 5.0% Δp: -2.602%
46
+ 1.0% Δp: -6.889%
47
+ 0.1% Δp: -17.803%
48
+ Minimum Δp: -88.628%
49
+ RMS Δp : 2.229 ± 0.037 %
50
+ Same top p: 96.672 ± 0.047 %
scores/gemma-4-E4B-it-q6_k.tqa ADDED
@@ -0,0 +1,17 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 32 tensors
4
+ llama_model_loader: - type q5_1: 8 tensors
5
+ llama_model_loader: - type q8_0: 91 tensors
6
+ llama_model_loader: - type q5_K: 2 tensors
7
+ llama_model_loader: - type q6_K: 248 tensors
8
+ print_info: file format = GGUF V3 (latest)
9
+ print_info: file type = Q6_K
10
+ print_info: file size = 5.69 GiB (6.50 BPW)
11
+
12
+ multiple_choice_score: there are 817 tasks in prompt
13
+ multiple_choice_score: selecting 750 random tasks from 817 tasks available
14
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
15
+
16
+ Final result: 33.8667 +/- 1.7292
17
+ Random chance: 19.8992 +/- 1.4588
scores/gemma-4-E4B-it-q6_k.wng ADDED
@@ -0,0 +1,15 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 32 tensors
4
+ llama_model_loader: - type q5_1: 8 tensors
5
+ llama_model_loader: - type q8_0: 91 tensors
6
+ llama_model_loader: - type q5_K: 2 tensors
7
+ llama_model_loader: - type q6_K: 248 tensors
8
+ print_info: file format = GGUF V3 (latest)
9
+ print_info: file type = Q6_K
10
+ print_info: file size = 5.69 GiB (6.50 BPW)
11
+
12
+ winogrande_score : loaded 1267 tasks from prompt.
13
+ winogrande_score : selecting 750 random tasks
14
+
15
+ Final Winogrande score(750 tasks): 66.5333 +/- 1.7242
scores/gemma-4-E4B-it-q7_k.arc ADDED
@@ -0,0 +1,16 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 52 tensors
4
+ llama_model_loader: - type q5_1: 1 tensors
5
+ llama_model_loader: - type q8_0: 274 tensors
6
+ llama_model_loader: - type q6_K: 54 tensors
7
+ print_info: file format = GGUF V3 (latest)
8
+ print_info: file type = Q8_0
9
+ print_info: file size = 6.56 GiB (7.50 BPW)
10
+
11
+ multiple_choice_score: there are 869 tasks in prompt
12
+ multiple_choice_score: selecting 750 random tasks from 869 tasks available
13
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
14
+
15
+ Final result: 57.2000 +/- 1.8079
16
+ Random chance: 25.0083 +/- 1.5824
scores/gemma-4-E4B-it-q7_k.hsw ADDED
@@ -0,0 +1,15 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 52 tensors
4
+ llama_model_loader: - type q5_1: 1 tensors
5
+ llama_model_loader: - type q8_0: 274 tensors
6
+ llama_model_loader: - type q6_K: 54 tensors
7
+ print_info: file format = GGUF V3 (latest)
8
+ print_info: file type = Q8_0
9
+ print_info: file size = 6.56 GiB (7.50 BPW)
10
+
11
+ hellaswag_score : loaded 10042 tasks from prompt.
12
+ hellaswag_score : selecting 750 randomized tasks.
13
+ hellaswag_score : calculating hellaswag score over selected tasks.
14
+
15
+ 750 68.00000000% [64.5771%, 71.2395%]
scores/gemma-4-E4B-it-q7_k.mmlu ADDED
@@ -0,0 +1,16 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 52 tensors
4
+ llama_model_loader: - type q5_1: 1 tensors
5
+ llama_model_loader: - type q8_0: 274 tensors
6
+ llama_model_loader: - type q6_K: 54 tensors
7
+ print_info: file format = GGUF V3 (latest)
8
+ print_info: file type = Q8_0
9
+ print_info: file size = 6.56 GiB (7.50 BPW)
10
+
11
+ multiple_choice_score: there are 5362 tasks in prompt
12
+ multiple_choice_score: selecting 750 random tasks from 5362 tasks available
13
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
14
+
15
+ Final result: 66.5333 +/- 1.7242
16
+ Random chance: 25.0000 +/- 1.5822
scores/gemma-4-E4B-it-q7_k.ppx ADDED
@@ -0,0 +1,49 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 52 tensors
4
+ llama_model_loader: - type q5_1: 1 tensors
5
+ llama_model_loader: - type q8_0: 274 tensors
6
+ llama_model_loader: - type q6_K: 54 tensors
7
+ print_info: file format = GGUF V3 (latest)
8
+ print_info: file type = Q8_0
9
+ print_info: file size = 6.56 GiB (7.50 BPW)
10
+
11
+ ====== Perplexity statistics ======
12
+ Mean PPL(Q) : 57.909227 ± 0.717870
13
+ Mean PPL(base) : 52.693235 ± 0.610088
14
+ Cor(ln(PPL(Q)), ln(PPL(base))): 98.55%
15
+ Mean ln(PPL(Q)/PPL(base)) : 0.094390 ± 0.002196
16
+ Mean PPL(Q)/PPL(base) : 1.098988 ± 0.002413
17
+ Mean PPL(Q)-PPL(base) : 5.215993 ± 0.155827
18
+
19
+ ====== KL divergence statistics ======
20
+ Mean KLD: 0.003237 ± 0.000086
21
+ Maximum KLD: 8.411139
22
+ 99.9% KLD: 0.152386
23
+ 99.0% KLD: 0.029975
24
+ 95.0% KLD: 0.010175
25
+ 90.0% KLD: 0.006270
26
+ Median KLD: 0.000917
27
+ 10.0% KLD: 0.000005
28
+ 5.0% KLD: 0.000001
29
+ 1.0% KLD: -0.000001
30
+ 0.1% KLD: -0.000006
31
+ Minimum KLD: -0.000048
32
+
33
+ ====== Token probability statistics ======
34
+ Mean Δp: -0.062 ± 0.004 %
35
+ Maximum Δp: 74.921%
36
+ 99.9% Δp: 10.826%
37
+ 99.0% Δp: 4.042%
38
+ 95.0% Δp: 1.411%
39
+ 90.0% Δp: 0.565%
40
+ 75.0% Δp: 0.027%
41
+ Median Δp: -0.000%
42
+ 25.0% Δp: -0.072%
43
+ 10.0% Δp: -0.796%
44
+ 5.0% Δp: -1.764%
45
+ 1.0% Δp: -4.686%
46
+ 0.1% Δp: -11.661%
47
+ Minimum Δp: -87.893%
48
+ RMS Δp : 1.534 ± 0.034 %
49
+ Same top p: 97.743 ± 0.039 %
scores/gemma-4-E4B-it-q7_k.tqa ADDED
@@ -0,0 +1,16 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 52 tensors
4
+ llama_model_loader: - type q5_1: 1 tensors
5
+ llama_model_loader: - type q8_0: 274 tensors
6
+ llama_model_loader: - type q6_K: 54 tensors
7
+ print_info: file format = GGUF V3 (latest)
8
+ print_info: file type = Q8_0
9
+ print_info: file size = 6.56 GiB (7.50 BPW)
10
+
11
+ multiple_choice_score: there are 817 tasks in prompt
12
+ multiple_choice_score: selecting 750 random tasks from 817 tasks available
13
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
14
+
15
+ Final result: 33.7333 +/- 1.7276
16
+ Random chance: 19.8992 +/- 1.4588
scores/gemma-4-E4B-it-q7_k.wng ADDED
@@ -0,0 +1,14 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 52 tensors
4
+ llama_model_loader: - type q5_1: 1 tensors
5
+ llama_model_loader: - type q8_0: 274 tensors
6
+ llama_model_loader: - type q6_K: 54 tensors
7
+ print_info: file format = GGUF V3 (latest)
8
+ print_info: file type = Q8_0
9
+ print_info: file size = 6.56 GiB (7.50 BPW)
10
+
11
+ winogrande_score : loaded 1267 tasks from prompt.
12
+ winogrande_score : selecting 750 random tasks
13
+
14
+ Final Winogrande score(750 tasks): 66.6667 +/- 1.7225
scores/gemma-4-E4B-it-q8_0.arc ADDED
@@ -0,0 +1,15 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 60 tensors
4
+ llama_model_loader: - type q8_0: 309 tensors
5
+ llama_model_loader: - type q6_K: 12 tensors
6
+ print_info: file format = GGUF V3 (latest)
7
+ print_info: file type = Q8_0
8
+ print_info: file size = 7.44 GiB (8.50 BPW)
9
+
10
+ multiple_choice_score: there are 869 tasks in prompt
11
+ multiple_choice_score: selecting 750 random tasks from 869 tasks available
12
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
13
+
14
+ Final result: 56.9333 +/- 1.8093
15
+ Random chance: 25.0083 +/- 1.5824
scores/gemma-4-E4B-it-q8_0.hsw ADDED
@@ -0,0 +1,14 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 60 tensors
4
+ llama_model_loader: - type q8_0: 309 tensors
5
+ llama_model_loader: - type q6_K: 12 tensors
6
+ print_info: file format = GGUF V3 (latest)
7
+ print_info: file type = Q8_0
8
+ print_info: file size = 7.44 GiB (8.50 BPW)
9
+
10
+ hellaswag_score : loaded 10042 tasks from prompt.
11
+ hellaswag_score : selecting 750 randomized tasks.
12
+ hellaswag_score : calculating hellaswag score over selected tasks.
13
+
14
+ 750 68.00000000% [64.5771%, 71.2395%]
scores/gemma-4-E4B-it-q8_0.mmlu ADDED
@@ -0,0 +1,15 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 60 tensors
4
+ llama_model_loader: - type q8_0: 309 tensors
5
+ llama_model_loader: - type q6_K: 12 tensors
6
+ print_info: file format = GGUF V3 (latest)
7
+ print_info: file type = Q8_0
8
+ print_info: file size = 7.44 GiB (8.50 BPW)
9
+
10
+ multiple_choice_score: there are 5362 tasks in prompt
11
+ multiple_choice_score: selecting 750 random tasks from 5362 tasks available
12
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
13
+
14
+ Final result: 66.5333 +/- 1.7242
15
+ Random chance: 25.0000 +/- 1.5822
scores/gemma-4-E4B-it-q8_0.ppx ADDED
@@ -0,0 +1,48 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 60 tensors
4
+ llama_model_loader: - type q8_0: 309 tensors
5
+ llama_model_loader: - type q6_K: 12 tensors
6
+ print_info: file format = GGUF V3 (latest)
7
+ print_info: file type = Q8_0
8
+ print_info: file size = 7.44 GiB (8.50 BPW)
9
+
10
+ ====== Perplexity statistics ======
11
+ Mean PPL(Q) : 57.324375 ± 0.708968
12
+ Mean PPL(base) : 52.693235 ± 0.610088
13
+ Cor(ln(PPL(Q)), ln(PPL(base))): 98.58%
14
+ Mean ln(PPL(Q)/PPL(base)) : 0.084239 ± 0.002164
15
+ Mean PPL(Q)/PPL(base) : 1.087889 ± 0.002354
16
+ Mean PPL(Q)-PPL(base) : 4.631141 ± 0.148444
17
+
18
+ ====== KL divergence statistics ======
19
+ Mean KLD: 0.001798 ± 0.000059
20
+ Maximum KLD: 4.473496
21
+ 99.9% KLD: 0.106441
22
+ 99.0% KLD: 0.015963
23
+ 95.0% KLD: 0.005257
24
+ 90.0% KLD: 0.003187
25
+ Median KLD: 0.000441
26
+ 10.0% KLD: 0.000003
27
+ 5.0% KLD: 0.000000
28
+ 1.0% KLD: -0.000001
29
+ 0.1% KLD: -0.000007
30
+ Minimum KLD: -0.000047
31
+
32
+ ====== Token probability statistics ======
33
+ Mean Δp: -0.020 ± 0.003 %
34
+ Maximum Δp: 71.373%
35
+ 99.9% Δp: 8.424%
36
+ 99.0% Δp: 3.038%
37
+ 95.0% Δp: 1.051%
38
+ 90.0% Δp: 0.443%
39
+ 75.0% Δp: 0.026%
40
+ Median Δp: -0.000%
41
+ 25.0% Δp: -0.037%
42
+ 10.0% Δp: -0.510%
43
+ 5.0% Δp: -1.171%
44
+ 1.0% Δp: -3.218%
45
+ 0.1% Δp: -8.574%
46
+ Minimum Δp: -88.102%
47
+ RMS Δp : 1.155 ± 0.038 %
48
+ Same top p: 98.371 ± 0.033 %
scores/gemma-4-E4B-it-q8_0.tqa ADDED
@@ -0,0 +1,15 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 60 tensors
4
+ llama_model_loader: - type q8_0: 309 tensors
5
+ llama_model_loader: - type q6_K: 12 tensors
6
+ print_info: file format = GGUF V3 (latest)
7
+ print_info: file type = Q8_0
8
+ print_info: file size = 7.44 GiB (8.50 BPW)
9
+
10
+ multiple_choice_score: there are 817 tasks in prompt
11
+ multiple_choice_score: selecting 750 random tasks from 817 tasks available
12
+ multiple_choice_score : calculating TruthfulQA score over 750 tasks.
13
+
14
+ Final result: 34.0000 +/- 1.7309
15
+ Random chance: 19.8992 +/- 1.4588
scores/gemma-4-E4B-it-q8_0.wng ADDED
@@ -0,0 +1,13 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
2
+ llama_model_loader: - type f32: 339 tensors
3
+ llama_model_loader: - type f16: 60 tensors
4
+ llama_model_loader: - type q8_0: 309 tensors
5
+ llama_model_loader: - type q6_K: 12 tensors
6
+ print_info: file format = GGUF V3 (latest)
7
+ print_info: file type = Q8_0
8
+ print_info: file size = 7.44 GiB (8.50 BPW)
9
+
10
+ winogrande_score : loaded 1267 tasks from prompt.
11
+ winogrande_score : selecting 750 random tasks
12
+
13
+ Final Winogrande score(750 tasks): 67.0667 +/- 1.7172