Instructions to use eaddario/gemma-4-E4B-it-GGUF with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- llama.cpp
How to use eaddario/gemma-4-E4B-it-GGUF with llama.cpp:
Install (macOS, Linux)
curl -LsSf https://llama.app/install.sh | sh # Start a local OpenAI-compatible server with a web UI: llama serve -hf eaddario/gemma-4-E4B-it-GGUF:F16 # Run inference directly in the terminal: llama cli -hf eaddario/gemma-4-E4B-it-GGUF:F16
Install from WinGet (Windows)
winget install llama.cpp # Start a local OpenAI-compatible server with a web UI: llama serve -hf eaddario/gemma-4-E4B-it-GGUF:F16 # Run inference directly in the terminal: llama cli -hf eaddario/gemma-4-E4B-it-GGUF:F16
Use pre-built binary
# Download pre-built binary from: # https://github.com/ggerganov/llama.cpp/releases # Start a local OpenAI-compatible server with a web UI: ./llama-server -hf eaddario/gemma-4-E4B-it-GGUF:F16 # Run inference directly in the terminal: ./llama-cli -hf eaddario/gemma-4-E4B-it-GGUF:F16
Build from source code
git clone https://github.com/ggerganov/llama.cpp.git cd llama.cpp cmake -B build cmake --build build -j --target llama-server llama-cli # Start a local OpenAI-compatible server with a web UI: ./build/bin/llama-server -hf eaddario/gemma-4-E4B-it-GGUF:F16 # Run inference directly in the terminal: ./build/bin/llama-cli -hf eaddario/gemma-4-E4B-it-GGUF:F16
Use Docker
docker model run hf.co/eaddario/gemma-4-E4B-it-GGUF:F16
- LM Studio
- Jan
- Ollama
How to use eaddario/gemma-4-E4B-it-GGUF with Ollama:
ollama run hf.co/eaddario/gemma-4-E4B-it-GGUF:F16
- Unsloth Desktop
- Pi
How to use eaddario/gemma-4-E4B-it-GGUF with Pi:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf eaddario/gemma-4-E4B-it-GGUF:F16
Configure the model in Pi
# Install Pi: npm install -g @earendil-works/pi-coding-agent # Add to ~/.pi/agent/models.json: { "providers": { "llama-cpp": { "baseUrl": "http://localhost:8080/v1", "api": "openai-completions", "apiKey": "none", "models": [ { "id": "eaddario/gemma-4-E4B-it-GGUF:F16" } ] } } }Run Pi
# Start Pi in your project directory: pi
- Docker Model Runner
How to use eaddario/gemma-4-E4B-it-GGUF with Docker Model Runner:
docker model run hf.co/eaddario/gemma-4-E4B-it-GGUF:F16
- Lemonade
How to use eaddario/gemma-4-E4B-it-GGUF with Lemonade:
Pull the model
# Download Lemonade from https://lemonade-server.ai/ lemonade pull eaddario/gemma-4-E4B-it-GGUF:F16
Run and chat with the model
lemonade run user.gemma-4-E4B-it-GGUF-F16
List all available models
lemonade list
- Hermes Agent
How to use eaddario/gemma-4-E4B-it-GGUF with Hermes Agent:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf eaddario/gemma-4-E4B-it-GGUF:F16
Configure Hermes
# Install Hermes: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash hermes setup # Point Hermes at the local server: hermes config set model.provider custom hermes config set model.base_url http://127.0.0.1:8080/v1 hermes config set model.default eaddario/gemma-4-E4B-it-GGUF:F16
Run Hermes
hermes
- Atomic Chat
- OpenClaw
How to use eaddario/gemma-4-E4B-it-GGUF with OpenClaw:
Start the llama.cpp server
# Install llama.cpp: brew install llama.cpp # Start a local OpenAI-compatible server: llama serve -hf eaddario/gemma-4-E4B-it-GGUF:F16
Configure OpenClaw
# Install OpenClaw: npm install -g openclaw@latest # Register the local server and set it as the default model: openclaw onboard --non-interactive --mode local \ --auth-choice custom-api-key \ --custom-base-url http://127.0.0.1:8080/v1 \ --custom-model-id "eaddario/gemma-4-E4B-it-GGUF:F16" \ --custom-provider-id llama-cpp \ --custom-compatibility openai \ --custom-text-input \ --accept-risk \ --skip-health
Run OpenClaw
openclaw agent --local --agent main --message "Hello from Hugging Face"
Generate Perplexity, KLD, ARC, HellaSwag, MMLU, Truthful QA and WinoGrande scores
Browse files- scores/gemma-4-E4B-it-q2_k.arc +23 -0
- scores/gemma-4-E4B-it-q2_k.hsw +22 -0
- scores/gemma-4-E4B-it-q2_k.mmlu +23 -0
- scores/gemma-4-E4B-it-q2_k.ppx +56 -0
- scores/gemma-4-E4B-it-q2_k.tqa +23 -0
- scores/gemma-4-E4B-it-q2_k.wng +21 -0
- scores/gemma-4-E4B-it-q3_k.arc +23 -0
- scores/gemma-4-E4B-it-q3_k.hsw +22 -0
- scores/gemma-4-E4B-it-q3_k.mmlu +23 -0
- scores/gemma-4-E4B-it-q3_k.ppx +56 -0
- scores/gemma-4-E4B-it-q3_k.tqa +23 -0
- scores/gemma-4-E4B-it-q3_k.wng +21 -0
- scores/gemma-4-E4B-it-q4_k.arc +21 -0
- scores/gemma-4-E4B-it-q4_k.hsw +20 -0
- scores/gemma-4-E4B-it-q4_k.mmlu +21 -0
- scores/gemma-4-E4B-it-q4_k.ppx +54 -0
- scores/gemma-4-E4B-it-q4_k.tqa +21 -0
- scores/gemma-4-E4B-it-q4_k.wng +19 -0
- scores/gemma-4-E4B-it-q5_k.arc +18 -0
- scores/gemma-4-E4B-it-q5_k.hsw +17 -0
- scores/gemma-4-E4B-it-q5_k.mmlu +18 -0
- scores/gemma-4-E4B-it-q5_k.ppx +51 -0
- scores/gemma-4-E4B-it-q5_k.tqa +18 -0
- scores/gemma-4-E4B-it-q5_k.wng +16 -0
- scores/gemma-4-E4B-it-q6_k.arc +17 -0
- scores/gemma-4-E4B-it-q6_k.hsw +16 -0
- scores/gemma-4-E4B-it-q6_k.mmlu +17 -0
- scores/gemma-4-E4B-it-q6_k.ppx +50 -0
- scores/gemma-4-E4B-it-q6_k.tqa +17 -0
- scores/gemma-4-E4B-it-q6_k.wng +15 -0
- scores/gemma-4-E4B-it-q7_k.arc +16 -0
- scores/gemma-4-E4B-it-q7_k.hsw +15 -0
- scores/gemma-4-E4B-it-q7_k.mmlu +16 -0
- scores/gemma-4-E4B-it-q7_k.ppx +49 -0
- scores/gemma-4-E4B-it-q7_k.tqa +16 -0
- scores/gemma-4-E4B-it-q7_k.wng +14 -0
- scores/gemma-4-E4B-it-q8_0.arc +15 -0
- scores/gemma-4-E4B-it-q8_0.hsw +14 -0
- scores/gemma-4-E4B-it-q8_0.mmlu +15 -0
- scores/gemma-4-E4B-it-q8_0.ppx +48 -0
- scores/gemma-4-E4B-it-q8_0.tqa +15 -0
- scores/gemma-4-E4B-it-q8_0.wng +13 -0
scores/gemma-4-E4B-it-q2_k.arc
ADDED
|
@@ -0,0 +1,23 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 7 tensors
|
| 5 |
+
llama_model_loader: - type q2_K: 112 tensors
|
| 6 |
+
llama_model_loader: - type q3_K: 36 tensors
|
| 7 |
+
llama_model_loader: - type q4_K: 15 tensors
|
| 8 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 9 |
+
llama_model_loader: - type iq2_xxs: 94 tensors
|
| 10 |
+
llama_model_loader: - type iq2_xs: 38 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 38 tensors
|
| 12 |
+
llama_model_loader: - type iq4_xs: 2 tensors
|
| 13 |
+
llama_model_loader: - type iq1_m: 36 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ2_S - 2.5 bpw
|
| 16 |
+
print_info: file size = 2.19 GiB (2.50 BPW)
|
| 17 |
+
|
| 18 |
+
multiple_choice_score: there are 869 tasks in prompt
|
| 19 |
+
multiple_choice_score: selecting 750 random tasks from 869 tasks available
|
| 20 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 21 |
+
|
| 22 |
+
Final result: 34.8000 +/- 1.7405
|
| 23 |
+
Random chance: 25.0083 +/- 1.5824
|
scores/gemma-4-E4B-it-q2_k.hsw
ADDED
|
@@ -0,0 +1,22 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 7 tensors
|
| 5 |
+
llama_model_loader: - type q2_K: 112 tensors
|
| 6 |
+
llama_model_loader: - type q3_K: 36 tensors
|
| 7 |
+
llama_model_loader: - type q4_K: 15 tensors
|
| 8 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 9 |
+
llama_model_loader: - type iq2_xxs: 94 tensors
|
| 10 |
+
llama_model_loader: - type iq2_xs: 38 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 38 tensors
|
| 12 |
+
llama_model_loader: - type iq4_xs: 2 tensors
|
| 13 |
+
llama_model_loader: - type iq1_m: 36 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ2_S - 2.5 bpw
|
| 16 |
+
print_info: file size = 2.19 GiB (2.50 BPW)
|
| 17 |
+
|
| 18 |
+
hellaswag_score : loaded 10042 tasks from prompt.
|
| 19 |
+
hellaswag_score : selecting 750 randomized tasks.
|
| 20 |
+
hellaswag_score : calculating hellaswag score over selected tasks.
|
| 21 |
+
|
| 22 |
+
750 42.53333333% [39.0419%, 46.1008%]
|
scores/gemma-4-E4B-it-q2_k.mmlu
ADDED
|
@@ -0,0 +1,23 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 7 tensors
|
| 5 |
+
llama_model_loader: - type q2_K: 112 tensors
|
| 6 |
+
llama_model_loader: - type q3_K: 36 tensors
|
| 7 |
+
llama_model_loader: - type q4_K: 15 tensors
|
| 8 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 9 |
+
llama_model_loader: - type iq2_xxs: 94 tensors
|
| 10 |
+
llama_model_loader: - type iq2_xs: 38 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 38 tensors
|
| 12 |
+
llama_model_loader: - type iq4_xs: 2 tensors
|
| 13 |
+
llama_model_loader: - type iq1_m: 36 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ2_S - 2.5 bpw
|
| 16 |
+
print_info: file size = 2.19 GiB (2.50 BPW)
|
| 17 |
+
|
| 18 |
+
multiple_choice_score: there are 5362 tasks in prompt
|
| 19 |
+
multiple_choice_score: selecting 750 random tasks from 5362 tasks available
|
| 20 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 21 |
+
|
| 22 |
+
Final result: 34.1333 +/- 1.7325
|
| 23 |
+
Random chance: 25.0000 +/- 1.5822
|
scores/gemma-4-E4B-it-q2_k.ppx
ADDED
|
@@ -0,0 +1,56 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 7 tensors
|
| 5 |
+
llama_model_loader: - type q2_K: 112 tensors
|
| 6 |
+
llama_model_loader: - type q3_K: 36 tensors
|
| 7 |
+
llama_model_loader: - type q4_K: 15 tensors
|
| 8 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 9 |
+
llama_model_loader: - type iq2_xxs: 94 tensors
|
| 10 |
+
llama_model_loader: - type iq2_xs: 38 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 38 tensors
|
| 12 |
+
llama_model_loader: - type iq4_xs: 2 tensors
|
| 13 |
+
llama_model_loader: - type iq1_m: 36 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ2_S - 2.5 bpw
|
| 16 |
+
print_info: file size = 2.19 GiB (2.50 BPW)
|
| 17 |
+
|
| 18 |
+
====== Perplexity statistics ======
|
| 19 |
+
Mean PPL(Q) : 158.513459 ± 1.991659
|
| 20 |
+
Mean PPL(base) : 52.693235 ± 0.610088
|
| 21 |
+
Cor(ln(PPL(Q)), ln(PPL(base))): 70.11%
|
| 22 |
+
Mean ln(PPL(Q)/PPL(base)) : 1.101352 ± 0.009377
|
| 23 |
+
Mean PPL(Q)/PPL(base) : 3.008232 ± 0.028209
|
| 24 |
+
Mean PPL(Q)-PPL(base) : 105.820225 ± 1.623290
|
| 25 |
+
|
| 26 |
+
====== KL divergence statistics ======
|
| 27 |
+
Mean KLD: 2.371872 ± 0.006399
|
| 28 |
+
Maximum KLD: 30.074741
|
| 29 |
+
99.9% KLD: 16.281898
|
| 30 |
+
99.0% KLD: 10.876118
|
| 31 |
+
95.0% KLD: 7.153347
|
| 32 |
+
90.0% KLD: 5.582164
|
| 33 |
+
Median KLD: 1.691821
|
| 34 |
+
10.0% KLD: 0.054692
|
| 35 |
+
5.0% KLD: 0.010447
|
| 36 |
+
1.0% KLD: 0.000600
|
| 37 |
+
0.1% KLD: 0.000037
|
| 38 |
+
Minimum KLD: 0.000000
|
| 39 |
+
|
| 40 |
+
====== Token probability statistics ======
|
| 41 |
+
Mean Δp: -13.185 ± 0.082 %
|
| 42 |
+
Maximum Δp: 99.835%
|
| 43 |
+
99.9% Δp: 89.775%
|
| 44 |
+
99.0% Δp: 59.588%
|
| 45 |
+
95.0% Δp: 19.010%
|
| 46 |
+
90.0% Δp: 4.926%
|
| 47 |
+
75.0% Δp: 0.030%
|
| 48 |
+
Median Δp: -0.543%
|
| 49 |
+
25.0% Δp: -18.065%
|
| 50 |
+
10.0% Δp: -66.818%
|
| 51 |
+
5.0% Δp: -88.176%
|
| 52 |
+
1.0% Δp: -99.296%
|
| 53 |
+
0.1% Δp: -99.987%
|
| 54 |
+
Minimum Δp: -100.000%
|
| 55 |
+
RMS Δp : 33.940 ± 0.093 %
|
| 56 |
+
Same top p: 44.998 ± 0.130 %
|
scores/gemma-4-E4B-it-q2_k.tqa
ADDED
|
@@ -0,0 +1,23 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 7 tensors
|
| 5 |
+
llama_model_loader: - type q2_K: 112 tensors
|
| 6 |
+
llama_model_loader: - type q3_K: 36 tensors
|
| 7 |
+
llama_model_loader: - type q4_K: 15 tensors
|
| 8 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 9 |
+
llama_model_loader: - type iq2_xxs: 94 tensors
|
| 10 |
+
llama_model_loader: - type iq2_xs: 38 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 38 tensors
|
| 12 |
+
llama_model_loader: - type iq4_xs: 2 tensors
|
| 13 |
+
llama_model_loader: - type iq1_m: 36 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ2_S - 2.5 bpw
|
| 16 |
+
print_info: file size = 2.19 GiB (2.50 BPW)
|
| 17 |
+
|
| 18 |
+
multiple_choice_score: there are 817 tasks in prompt
|
| 19 |
+
multiple_choice_score: selecting 750 random tasks from 817 tasks available
|
| 20 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 21 |
+
|
| 22 |
+
Final result: 28.1333 +/- 1.6430
|
| 23 |
+
Random chance: 19.8992 +/- 1.4588
|
scores/gemma-4-E4B-it-q2_k.wng
ADDED
|
@@ -0,0 +1,21 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 7 tensors
|
| 5 |
+
llama_model_loader: - type q2_K: 112 tensors
|
| 6 |
+
llama_model_loader: - type q3_K: 36 tensors
|
| 7 |
+
llama_model_loader: - type q4_K: 15 tensors
|
| 8 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 9 |
+
llama_model_loader: - type iq2_xxs: 94 tensors
|
| 10 |
+
llama_model_loader: - type iq2_xs: 38 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 38 tensors
|
| 12 |
+
llama_model_loader: - type iq4_xs: 2 tensors
|
| 13 |
+
llama_model_loader: - type iq1_m: 36 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ2_S - 2.5 bpw
|
| 16 |
+
print_info: file size = 2.19 GiB (2.50 BPW)
|
| 17 |
+
|
| 18 |
+
winogrande_score : loaded 1267 tasks from prompt.
|
| 19 |
+
winogrande_score : selecting 750 random tasks
|
| 20 |
+
|
| 21 |
+
Final Winogrande score(750 tasks): 51.8667 +/- 1.8257
|
scores/gemma-4-E4B-it-q3_k.arc
ADDED
|
@@ -0,0 +1,23 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 11 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 6 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 1 tensors
|
| 7 |
+
llama_model_loader: - type q2_K: 11 tensors
|
| 8 |
+
llama_model_loader: - type q3_K: 118 tensors
|
| 9 |
+
llama_model_loader: - type q4_K: 41 tensors
|
| 10 |
+
llama_model_loader: - type q5_K: 6 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 41 tensors
|
| 12 |
+
llama_model_loader: - type iq3_s: 49 tensors
|
| 13 |
+
llama_model_loader: - type iq4_xs: 96 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ4_XS - 4.25 bpw
|
| 16 |
+
print_info: file size = 3.06 GiB (3.50 BPW)
|
| 17 |
+
|
| 18 |
+
multiple_choice_score: there are 869 tasks in prompt
|
| 19 |
+
multiple_choice_score: selecting 750 random tasks from 869 tasks available
|
| 20 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 21 |
+
|
| 22 |
+
Final result: 54.0000 +/- 1.8211
|
| 23 |
+
Random chance: 25.0083 +/- 1.5824
|
scores/gemma-4-E4B-it-q3_k.hsw
ADDED
|
@@ -0,0 +1,22 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 11 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 6 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 1 tensors
|
| 7 |
+
llama_model_loader: - type q2_K: 11 tensors
|
| 8 |
+
llama_model_loader: - type q3_K: 118 tensors
|
| 9 |
+
llama_model_loader: - type q4_K: 41 tensors
|
| 10 |
+
llama_model_loader: - type q5_K: 6 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 41 tensors
|
| 12 |
+
llama_model_loader: - type iq3_s: 49 tensors
|
| 13 |
+
llama_model_loader: - type iq4_xs: 96 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ4_XS - 4.25 bpw
|
| 16 |
+
print_info: file size = 3.06 GiB (3.50 BPW)
|
| 17 |
+
|
| 18 |
+
hellaswag_score : loaded 10042 tasks from prompt.
|
| 19 |
+
hellaswag_score : selecting 750 randomized tasks.
|
| 20 |
+
hellaswag_score : calculating hellaswag score over selected tasks.
|
| 21 |
+
|
| 22 |
+
750 61.46666667% [57.9336%, 64.8829%]
|
scores/gemma-4-E4B-it-q3_k.mmlu
ADDED
|
@@ -0,0 +1,23 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 11 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 6 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 1 tensors
|
| 7 |
+
llama_model_loader: - type q2_K: 11 tensors
|
| 8 |
+
llama_model_loader: - type q3_K: 118 tensors
|
| 9 |
+
llama_model_loader: - type q4_K: 41 tensors
|
| 10 |
+
llama_model_loader: - type q5_K: 6 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 41 tensors
|
| 12 |
+
llama_model_loader: - type iq3_s: 49 tensors
|
| 13 |
+
llama_model_loader: - type iq4_xs: 96 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ4_XS - 4.25 bpw
|
| 16 |
+
print_info: file size = 3.06 GiB (3.50 BPW)
|
| 17 |
+
|
| 18 |
+
multiple_choice_score: there are 5362 tasks in prompt
|
| 19 |
+
multiple_choice_score: selecting 750 random tasks from 5362 tasks available
|
| 20 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 21 |
+
|
| 22 |
+
Final result: 64.6667 +/- 1.7466
|
| 23 |
+
Random chance: 25.0000 +/- 1.5822
|
scores/gemma-4-E4B-it-q3_k.ppx
ADDED
|
@@ -0,0 +1,56 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 11 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 6 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 1 tensors
|
| 7 |
+
llama_model_loader: - type q2_K: 11 tensors
|
| 8 |
+
llama_model_loader: - type q3_K: 118 tensors
|
| 9 |
+
llama_model_loader: - type q4_K: 41 tensors
|
| 10 |
+
llama_model_loader: - type q5_K: 6 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 41 tensors
|
| 12 |
+
llama_model_loader: - type iq3_s: 49 tensors
|
| 13 |
+
llama_model_loader: - type iq4_xs: 96 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ4_XS - 4.25 bpw
|
| 16 |
+
print_info: file size = 3.06 GiB (3.50 BPW)
|
| 17 |
+
|
| 18 |
+
====== Perplexity statistics ======
|
| 19 |
+
Mean PPL(Q) : 53.460778 ± 0.637355
|
| 20 |
+
Mean PPL(base) : 52.693235 ± 0.610088
|
| 21 |
+
Cor(ln(PPL(Q)), ln(PPL(base))): 93.43%
|
| 22 |
+
Mean ln(PPL(Q)/PPL(base)) : 0.014461 ± 0.004273
|
| 23 |
+
Mean PPL(Q)/PPL(base) : 1.014566 ± 0.004336
|
| 24 |
+
Mean PPL(Q)-PPL(base) : 0.767544 ± 0.227712
|
| 25 |
+
|
| 26 |
+
====== KL divergence statistics ======
|
| 27 |
+
Mean KLD: 0.368276 ± 0.001632
|
| 28 |
+
Maximum KLD: 16.233898
|
| 29 |
+
99.9% KLD: 6.639840
|
| 30 |
+
99.0% KLD: 2.925996
|
| 31 |
+
95.0% KLD: 1.350669
|
| 32 |
+
90.0% KLD: 0.914818
|
| 33 |
+
Median KLD: 0.166417
|
| 34 |
+
10.0% KLD: 0.001494
|
| 35 |
+
5.0% KLD: 0.000202
|
| 36 |
+
1.0% KLD: 0.000008
|
| 37 |
+
0.1% KLD: 0.000000
|
| 38 |
+
Minimum KLD: -0.000030
|
| 39 |
+
|
| 40 |
+
====== Token probability statistics ======
|
| 41 |
+
Mean Δp: -1.997 ± 0.038 %
|
| 42 |
+
Maximum Δp: 99.669%
|
| 43 |
+
99.9% Δp: 75.373%
|
| 44 |
+
99.0% Δp: 40.206%
|
| 45 |
+
95.0% Δp: 14.981%
|
| 46 |
+
90.0% Δp: 6.041%
|
| 47 |
+
75.0% Δp: 0.341%
|
| 48 |
+
Median Δp: -0.002%
|
| 49 |
+
25.0% Δp: -1.599%
|
| 50 |
+
10.0% Δp: -13.659%
|
| 51 |
+
5.0% Δp: -27.491%
|
| 52 |
+
1.0% Δp: -61.928%
|
| 53 |
+
0.1% Δp: -94.101%
|
| 54 |
+
Minimum Δp: -99.998%
|
| 55 |
+
RMS Δp : 14.827 ± 0.072 %
|
| 56 |
+
Same top p: 75.953 ± 0.111 %
|
scores/gemma-4-E4B-it-q3_k.tqa
ADDED
|
@@ -0,0 +1,23 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 11 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 6 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 1 tensors
|
| 7 |
+
llama_model_loader: - type q2_K: 11 tensors
|
| 8 |
+
llama_model_loader: - type q3_K: 118 tensors
|
| 9 |
+
llama_model_loader: - type q4_K: 41 tensors
|
| 10 |
+
llama_model_loader: - type q5_K: 6 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 41 tensors
|
| 12 |
+
llama_model_loader: - type iq3_s: 49 tensors
|
| 13 |
+
llama_model_loader: - type iq4_xs: 96 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ4_XS - 4.25 bpw
|
| 16 |
+
print_info: file size = 3.06 GiB (3.50 BPW)
|
| 17 |
+
|
| 18 |
+
multiple_choice_score: there are 817 tasks in prompt
|
| 19 |
+
multiple_choice_score: selecting 750 random tasks from 817 tasks available
|
| 20 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 21 |
+
|
| 22 |
+
Final result: 33.3333 +/- 1.7225
|
| 23 |
+
Random chance: 19.8992 +/- 1.4588
|
scores/gemma-4-E4B-it-q3_k.wng
ADDED
|
@@ -0,0 +1,21 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 1 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 11 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 6 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 1 tensors
|
| 7 |
+
llama_model_loader: - type q2_K: 11 tensors
|
| 8 |
+
llama_model_loader: - type q3_K: 118 tensors
|
| 9 |
+
llama_model_loader: - type q4_K: 41 tensors
|
| 10 |
+
llama_model_loader: - type q5_K: 6 tensors
|
| 11 |
+
llama_model_loader: - type iq3_xxs: 41 tensors
|
| 12 |
+
llama_model_loader: - type iq3_s: 49 tensors
|
| 13 |
+
llama_model_loader: - type iq4_xs: 96 tensors
|
| 14 |
+
print_info: file format = GGUF V3 (latest)
|
| 15 |
+
print_info: file type = IQ4_XS - 4.25 bpw
|
| 16 |
+
print_info: file size = 3.06 GiB (3.50 BPW)
|
| 17 |
+
|
| 18 |
+
winogrande_score : loaded 1267 tasks from prompt.
|
| 19 |
+
winogrande_score : selecting 750 random tasks
|
| 20 |
+
|
| 21 |
+
Final Winogrande score(750 tasks): 66.6667 +/- 1.7225
|
scores/gemma-4-E4B-it-q4_k.arc
ADDED
|
@@ -0,0 +1,21 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 2 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 5 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 24 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 2 tensors
|
| 7 |
+
llama_model_loader: - type q3_K: 1 tensors
|
| 8 |
+
llama_model_loader: - type q4_K: 95 tensors
|
| 9 |
+
llama_model_loader: - type q5_K: 101 tensors
|
| 10 |
+
llama_model_loader: - type q6_K: 2 tensors
|
| 11 |
+
llama_model_loader: - type iq4_xs: 149 tensors
|
| 12 |
+
print_info: file format = GGUF V3 (latest)
|
| 13 |
+
print_info: file type = Q4_K - Medium
|
| 14 |
+
print_info: file size = 3.94 GiB (4.50 BPW)
|
| 15 |
+
|
| 16 |
+
multiple_choice_score: there are 869 tasks in prompt
|
| 17 |
+
multiple_choice_score: selecting 750 random tasks from 869 tasks available
|
| 18 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 19 |
+
|
| 20 |
+
Final result: 58.1333 +/- 1.8026
|
| 21 |
+
Random chance: 25.0083 +/- 1.5824
|
scores/gemma-4-E4B-it-q4_k.hsw
ADDED
|
@@ -0,0 +1,20 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 2 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 5 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 24 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 2 tensors
|
| 7 |
+
llama_model_loader: - type q3_K: 1 tensors
|
| 8 |
+
llama_model_loader: - type q4_K: 95 tensors
|
| 9 |
+
llama_model_loader: - type q5_K: 101 tensors
|
| 10 |
+
llama_model_loader: - type q6_K: 2 tensors
|
| 11 |
+
llama_model_loader: - type iq4_xs: 149 tensors
|
| 12 |
+
print_info: file format = GGUF V3 (latest)
|
| 13 |
+
print_info: file type = Q4_K - Medium
|
| 14 |
+
print_info: file size = 3.94 GiB (4.50 BPW)
|
| 15 |
+
|
| 16 |
+
hellaswag_score : loaded 10042 tasks from prompt.
|
| 17 |
+
hellaswag_score : selecting 750 randomized tasks.
|
| 18 |
+
hellaswag_score : calculating hellaswag score over selected tasks.
|
| 19 |
+
|
| 20 |
+
750 66.66666667% [63.2155%, 69.9479%]
|
scores/gemma-4-E4B-it-q4_k.mmlu
ADDED
|
@@ -0,0 +1,21 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 2 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 5 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 24 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 2 tensors
|
| 7 |
+
llama_model_loader: - type q3_K: 1 tensors
|
| 8 |
+
llama_model_loader: - type q4_K: 95 tensors
|
| 9 |
+
llama_model_loader: - type q5_K: 101 tensors
|
| 10 |
+
llama_model_loader: - type q6_K: 2 tensors
|
| 11 |
+
llama_model_loader: - type iq4_xs: 149 tensors
|
| 12 |
+
print_info: file format = GGUF V3 (latest)
|
| 13 |
+
print_info: file type = Q4_K - Medium
|
| 14 |
+
print_info: file size = 3.94 GiB (4.50 BPW)
|
| 15 |
+
|
| 16 |
+
multiple_choice_score: there are 5362 tasks in prompt
|
| 17 |
+
multiple_choice_score: selecting 750 random tasks from 5362 tasks available
|
| 18 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 19 |
+
|
| 20 |
+
Final result: 66.2667 +/- 1.7276
|
| 21 |
+
Random chance: 25.0000 +/- 1.5822
|
scores/gemma-4-E4B-it-q4_k.ppx
ADDED
|
@@ -0,0 +1,54 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 2 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 5 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 24 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 2 tensors
|
| 7 |
+
llama_model_loader: - type q3_K: 1 tensors
|
| 8 |
+
llama_model_loader: - type q4_K: 95 tensors
|
| 9 |
+
llama_model_loader: - type q5_K: 101 tensors
|
| 10 |
+
llama_model_loader: - type q6_K: 2 tensors
|
| 11 |
+
llama_model_loader: - type iq4_xs: 149 tensors
|
| 12 |
+
print_info: file format = GGUF V3 (latest)
|
| 13 |
+
print_info: file type = Q4_K - Medium
|
| 14 |
+
print_info: file size = 3.94 GiB (4.50 BPW)
|
| 15 |
+
|
| 16 |
+
====== Perplexity statistics ======
|
| 17 |
+
Mean PPL(Q) : 56.460364 ± 0.691942
|
| 18 |
+
Mean PPL(base) : 52.693235 ± 0.610088
|
| 19 |
+
Cor(ln(PPL(Q)), ln(PPL(base))): 97.35%
|
| 20 |
+
Mean ln(PPL(Q)/PPL(base)) : 0.069052 ± 0.002823
|
| 21 |
+
Mean PPL(Q)/PPL(base) : 1.071492 ± 0.003025
|
| 22 |
+
Mean PPL(Q)-PPL(base) : 3.767129 ± 0.170411
|
| 23 |
+
|
| 24 |
+
====== KL divergence statistics ======
|
| 25 |
+
Mean KLD: 0.095300 ± 0.000557
|
| 26 |
+
Maximum KLD: 15.853424
|
| 27 |
+
99.9% KLD: 2.527996
|
| 28 |
+
99.0% KLD: 0.863295
|
| 29 |
+
95.0% KLD: 0.356812
|
| 30 |
+
90.0% KLD: 0.229792
|
| 31 |
+
Median KLD: 0.035697
|
| 32 |
+
10.0% KLD: 0.000216
|
| 33 |
+
5.0% KLD: 0.000025
|
| 34 |
+
1.0% KLD: 0.000001
|
| 35 |
+
0.1% KLD: -0.000001
|
| 36 |
+
Minimum KLD: -0.000043
|
| 37 |
+
|
| 38 |
+
====== Token probability statistics ======
|
| 39 |
+
Mean Δp: -0.421 ± 0.020 %
|
| 40 |
+
Maximum Δp: 99.633%
|
| 41 |
+
99.9% Δp: 54.652%
|
| 42 |
+
99.0% Δp: 23.879%
|
| 43 |
+
95.0% Δp: 8.503%
|
| 44 |
+
90.0% Δp: 3.458%
|
| 45 |
+
75.0% Δp: 0.202%
|
| 46 |
+
Median Δp: -0.000%
|
| 47 |
+
25.0% Δp: -0.392%
|
| 48 |
+
10.0% Δp: -5.060%
|
| 49 |
+
5.0% Δp: -11.030%
|
| 50 |
+
1.0% Δp: -29.030%
|
| 51 |
+
0.1% Δp: -62.118%
|
| 52 |
+
Minimum Δp: -98.611%
|
| 53 |
+
RMS Δp : 7.866 ± 0.054 %
|
| 54 |
+
Same top p: 87.367 ± 0.087 %
|
scores/gemma-4-E4B-it-q4_k.tqa
ADDED
|
@@ -0,0 +1,21 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 2 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 5 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 24 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 2 tensors
|
| 7 |
+
llama_model_loader: - type q3_K: 1 tensors
|
| 8 |
+
llama_model_loader: - type q4_K: 95 tensors
|
| 9 |
+
llama_model_loader: - type q5_K: 101 tensors
|
| 10 |
+
llama_model_loader: - type q6_K: 2 tensors
|
| 11 |
+
llama_model_loader: - type iq4_xs: 149 tensors
|
| 12 |
+
print_info: file format = GGUF V3 (latest)
|
| 13 |
+
print_info: file type = Q4_K - Medium
|
| 14 |
+
print_info: file size = 3.94 GiB (4.50 BPW)
|
| 15 |
+
|
| 16 |
+
multiple_choice_score: there are 817 tasks in prompt
|
| 17 |
+
multiple_choice_score: selecting 750 random tasks from 817 tasks available
|
| 18 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 19 |
+
|
| 20 |
+
Final result: 32.5333 +/- 1.7119
|
| 21 |
+
Random chance: 19.8992 +/- 1.4588
|
scores/gemma-4-E4B-it-q4_k.wng
ADDED
|
@@ -0,0 +1,19 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 2 tensors
|
| 4 |
+
llama_model_loader: - type q4_1: 5 tensors
|
| 5 |
+
llama_model_loader: - type q5_1: 24 tensors
|
| 6 |
+
llama_model_loader: - type q8_0: 2 tensors
|
| 7 |
+
llama_model_loader: - type q3_K: 1 tensors
|
| 8 |
+
llama_model_loader: - type q4_K: 95 tensors
|
| 9 |
+
llama_model_loader: - type q5_K: 101 tensors
|
| 10 |
+
llama_model_loader: - type q6_K: 2 tensors
|
| 11 |
+
llama_model_loader: - type iq4_xs: 149 tensors
|
| 12 |
+
print_info: file format = GGUF V3 (latest)
|
| 13 |
+
print_info: file type = Q4_K - Medium
|
| 14 |
+
print_info: file size = 3.94 GiB (4.50 BPW)
|
| 15 |
+
|
| 16 |
+
winogrande_score : loaded 1267 tasks from prompt.
|
| 17 |
+
winogrande_score : selecting 750 random tasks
|
| 18 |
+
|
| 19 |
+
Final Winogrande score(750 tasks): 65.4667 +/- 1.7374
|
scores/gemma-4-E4B-it-q5_k.arc
ADDED
|
@@ -0,0 +1,18 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 13 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 28 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 6 tensors
|
| 6 |
+
llama_model_loader: - type q4_K: 3 tensors
|
| 7 |
+
llama_model_loader: - type q5_K: 158 tensors
|
| 8 |
+
llama_model_loader: - type q6_K: 173 tensors
|
| 9 |
+
print_info: file format = GGUF V3 (latest)
|
| 10 |
+
print_info: file type = Q5_K - Medium
|
| 11 |
+
print_info: file size = 4.81 GiB (5.50 BPW)
|
| 12 |
+
|
| 13 |
+
multiple_choice_score: there are 869 tasks in prompt
|
| 14 |
+
multiple_choice_score: selecting 750 random tasks from 869 tasks available
|
| 15 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 16 |
+
|
| 17 |
+
Final result: 57.4667 +/- 1.8065
|
| 18 |
+
Random chance: 25.0083 +/- 1.5824
|
scores/gemma-4-E4B-it-q5_k.hsw
ADDED
|
@@ -0,0 +1,17 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 13 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 28 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 6 tensors
|
| 6 |
+
llama_model_loader: - type q4_K: 3 tensors
|
| 7 |
+
llama_model_loader: - type q5_K: 158 tensors
|
| 8 |
+
llama_model_loader: - type q6_K: 173 tensors
|
| 9 |
+
print_info: file format = GGUF V3 (latest)
|
| 10 |
+
print_info: file type = Q5_K - Medium
|
| 11 |
+
print_info: file size = 4.81 GiB (5.50 BPW)
|
| 12 |
+
|
| 13 |
+
hellaswag_score : loaded 10042 tasks from prompt.
|
| 14 |
+
hellaswag_score : selecting 750 randomized tasks.
|
| 15 |
+
hellaswag_score : calculating hellaswag score over selected tasks.
|
| 16 |
+
|
| 17 |
+
750 68.13333333% [64.7134%, 71.3685%]
|
scores/gemma-4-E4B-it-q5_k.mmlu
ADDED
|
@@ -0,0 +1,18 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 13 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 28 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 6 tensors
|
| 6 |
+
llama_model_loader: - type q4_K: 3 tensors
|
| 7 |
+
llama_model_loader: - type q5_K: 158 tensors
|
| 8 |
+
llama_model_loader: - type q6_K: 173 tensors
|
| 9 |
+
print_info: file format = GGUF V3 (latest)
|
| 10 |
+
print_info: file type = Q5_K - Medium
|
| 11 |
+
print_info: file size = 4.81 GiB (5.50 BPW)
|
| 12 |
+
|
| 13 |
+
multiple_choice_score: there are 5362 tasks in prompt
|
| 14 |
+
multiple_choice_score: selecting 750 random tasks from 5362 tasks available
|
| 15 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 16 |
+
|
| 17 |
+
Final result: 67.4667 +/- 1.7119
|
| 18 |
+
Random chance: 25.0000 +/- 1.5822
|
scores/gemma-4-E4B-it-q5_k.ppx
ADDED
|
@@ -0,0 +1,51 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 13 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 28 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 6 tensors
|
| 6 |
+
llama_model_loader: - type q4_K: 3 tensors
|
| 7 |
+
llama_model_loader: - type q5_K: 158 tensors
|
| 8 |
+
llama_model_loader: - type q6_K: 173 tensors
|
| 9 |
+
print_info: file format = GGUF V3 (latest)
|
| 10 |
+
print_info: file type = Q5_K - Medium
|
| 11 |
+
print_info: file size = 4.81 GiB (5.50 BPW)
|
| 12 |
+
|
| 13 |
+
====== Perplexity statistics ======
|
| 14 |
+
Mean PPL(Q) : 58.576787 ± 0.727545
|
| 15 |
+
Mean PPL(base) : 52.693235 ± 0.610088
|
| 16 |
+
Cor(ln(PPL(Q)), ln(PPL(base))): 98.32%
|
| 17 |
+
Mean ln(PPL(Q)/PPL(base)) : 0.105851 ± 0.002352
|
| 18 |
+
Mean PPL(Q)/PPL(base) : 1.111657 ± 0.002615
|
| 19 |
+
Mean PPL(Q)-PPL(base) : 5.883553 ± 0.169353
|
| 20 |
+
|
| 21 |
+
====== KL divergence statistics ======
|
| 22 |
+
Mean KLD: 0.021173 ± 0.000200
|
| 23 |
+
Maximum KLD: 8.555525
|
| 24 |
+
99.9% KLD: 0.762584
|
| 25 |
+
99.0% KLD: 0.206188
|
| 26 |
+
95.0% KLD: 0.075586
|
| 27 |
+
90.0% KLD: 0.047285
|
| 28 |
+
Median KLD: 0.007055
|
| 29 |
+
10.0% KLD: 0.000044
|
| 30 |
+
5.0% KLD: 0.000005
|
| 31 |
+
1.0% KLD: -0.000000
|
| 32 |
+
0.1% KLD: -0.000002
|
| 33 |
+
Minimum KLD: -0.000057
|
| 34 |
+
|
| 35 |
+
====== Token probability statistics ======
|
| 36 |
+
Mean Δp: -0.211 ± 0.010 %
|
| 37 |
+
Maximum Δp: 95.665%
|
| 38 |
+
99.9% Δp: 29.084%
|
| 39 |
+
99.0% Δp: 10.904%
|
| 40 |
+
95.0% Δp: 3.685%
|
| 41 |
+
90.0% Δp: 1.450%
|
| 42 |
+
75.0% Δp: 0.063%
|
| 43 |
+
Median Δp: -0.000%
|
| 44 |
+
25.0% Δp: -0.216%
|
| 45 |
+
10.0% Δp: -2.289%
|
| 46 |
+
5.0% Δp: -4.984%
|
| 47 |
+
1.0% Δp: -12.990%
|
| 48 |
+
0.1% Δp: -30.230%
|
| 49 |
+
Minimum Δp: -92.949%
|
| 50 |
+
RMS Δp : 3.844 ± 0.042 %
|
| 51 |
+
Same top p: 94.144 ± 0.061 %
|
scores/gemma-4-E4B-it-q5_k.tqa
ADDED
|
@@ -0,0 +1,18 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 13 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 28 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 6 tensors
|
| 6 |
+
llama_model_loader: - type q4_K: 3 tensors
|
| 7 |
+
llama_model_loader: - type q5_K: 158 tensors
|
| 8 |
+
llama_model_loader: - type q6_K: 173 tensors
|
| 9 |
+
print_info: file format = GGUF V3 (latest)
|
| 10 |
+
print_info: file type = Q5_K - Medium
|
| 11 |
+
print_info: file size = 4.81 GiB (5.50 BPW)
|
| 12 |
+
|
| 13 |
+
multiple_choice_score: there are 817 tasks in prompt
|
| 14 |
+
multiple_choice_score: selecting 750 random tasks from 817 tasks available
|
| 15 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 16 |
+
|
| 17 |
+
Final result: 34.2667 +/- 1.7342
|
| 18 |
+
Random chance: 19.8992 +/- 1.4588
|
scores/gemma-4-E4B-it-q5_k.wng
ADDED
|
@@ -0,0 +1,16 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q5_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 13 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 28 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 6 tensors
|
| 6 |
+
llama_model_loader: - type q4_K: 3 tensors
|
| 7 |
+
llama_model_loader: - type q5_K: 158 tensors
|
| 8 |
+
llama_model_loader: - type q6_K: 173 tensors
|
| 9 |
+
print_info: file format = GGUF V3 (latest)
|
| 10 |
+
print_info: file type = Q5_K - Medium
|
| 11 |
+
print_info: file size = 4.81 GiB (5.50 BPW)
|
| 12 |
+
|
| 13 |
+
winogrande_score : loaded 1267 tasks from prompt.
|
| 14 |
+
winogrande_score : selecting 750 random tasks
|
| 15 |
+
|
| 16 |
+
Final Winogrande score(750 tasks): 67.3333 +/- 1.7137
|
scores/gemma-4-E4B-it-q6_k.arc
ADDED
|
@@ -0,0 +1,17 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 32 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 8 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 91 tensors
|
| 6 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 7 |
+
llama_model_loader: - type q6_K: 248 tensors
|
| 8 |
+
print_info: file format = GGUF V3 (latest)
|
| 9 |
+
print_info: file type = Q6_K
|
| 10 |
+
print_info: file size = 5.69 GiB (6.50 BPW)
|
| 11 |
+
|
| 12 |
+
multiple_choice_score: there are 869 tasks in prompt
|
| 13 |
+
multiple_choice_score: selecting 750 random tasks from 869 tasks available
|
| 14 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 15 |
+
|
| 16 |
+
Final result: 57.4667 +/- 1.8065
|
| 17 |
+
Random chance: 25.0083 +/- 1.5824
|
scores/gemma-4-E4B-it-q6_k.hsw
ADDED
|
@@ -0,0 +1,16 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 32 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 8 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 91 tensors
|
| 6 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 7 |
+
llama_model_loader: - type q6_K: 248 tensors
|
| 8 |
+
print_info: file format = GGUF V3 (latest)
|
| 9 |
+
print_info: file type = Q6_K
|
| 10 |
+
print_info: file size = 5.69 GiB (6.50 BPW)
|
| 11 |
+
|
| 12 |
+
hellaswag_score : loaded 10042 tasks from prompt.
|
| 13 |
+
hellaswag_score : selecting 750 randomized tasks.
|
| 14 |
+
hellaswag_score : calculating hellaswag score over selected tasks.
|
| 15 |
+
|
| 16 |
+
750 68.66666667% [65.2590%, 71.8841%]
|
scores/gemma-4-E4B-it-q6_k.mmlu
ADDED
|
@@ -0,0 +1,17 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 32 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 8 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 91 tensors
|
| 6 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 7 |
+
llama_model_loader: - type q6_K: 248 tensors
|
| 8 |
+
print_info: file format = GGUF V3 (latest)
|
| 9 |
+
print_info: file type = Q6_K
|
| 10 |
+
print_info: file size = 5.69 GiB (6.50 BPW)
|
| 11 |
+
|
| 12 |
+
multiple_choice_score: there are 5362 tasks in prompt
|
| 13 |
+
multiple_choice_score: selecting 750 random tasks from 5362 tasks available
|
| 14 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 15 |
+
|
| 16 |
+
Final result: 66.2667 +/- 1.7276
|
| 17 |
+
Random chance: 25.0000 +/- 1.5822
|
scores/gemma-4-E4B-it-q6_k.ppx
ADDED
|
@@ -0,0 +1,50 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 32 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 8 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 91 tensors
|
| 6 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 7 |
+
llama_model_loader: - type q6_K: 248 tensors
|
| 8 |
+
print_info: file format = GGUF V3 (latest)
|
| 9 |
+
print_info: file type = Q6_K
|
| 10 |
+
print_info: file size = 5.69 GiB (6.50 BPW)
|
| 11 |
+
|
| 12 |
+
====== Perplexity statistics ======
|
| 13 |
+
Mean PPL(Q) : 57.395025 ± 0.709393
|
| 14 |
+
Mean PPL(base) : 52.693235 ± 0.610088
|
| 15 |
+
Cor(ln(PPL(Q)), ln(PPL(base))): 98.51%
|
| 16 |
+
Mean ln(PPL(Q)/PPL(base)) : 0.085471 ± 0.002205
|
| 17 |
+
Mean PPL(Q)/PPL(base) : 1.089229 ± 0.002402
|
| 18 |
+
Mean PPL(Q)-PPL(base) : 4.701791 ± 0.150722
|
| 19 |
+
|
| 20 |
+
====== KL divergence statistics ======
|
| 21 |
+
Mean KLD: 0.006872 ± 0.000100
|
| 22 |
+
Maximum KLD: 3.890319
|
| 23 |
+
99.9% KLD: 0.332454
|
| 24 |
+
99.0% KLD: 0.064667
|
| 25 |
+
95.0% KLD: 0.022811
|
| 26 |
+
90.0% KLD: 0.013986
|
| 27 |
+
Median KLD: 0.002055
|
| 28 |
+
10.0% KLD: 0.000015
|
| 29 |
+
5.0% KLD: 0.000002
|
| 30 |
+
1.0% KLD: -0.000000
|
| 31 |
+
0.1% KLD: -0.000002
|
| 32 |
+
Minimum KLD: -0.000105
|
| 33 |
+
|
| 34 |
+
====== Token probability statistics ======
|
| 35 |
+
Mean Δp: -0.077 ± 0.006 %
|
| 36 |
+
Maximum Δp: 75.114%
|
| 37 |
+
99.9% Δp: 15.320%
|
| 38 |
+
99.0% Δp: 6.360%
|
| 39 |
+
95.0% Δp: 2.144%
|
| 40 |
+
90.0% Δp: 0.862%
|
| 41 |
+
75.0% Δp: 0.043%
|
| 42 |
+
Median Δp: -0.000%
|
| 43 |
+
25.0% Δp: -0.097%
|
| 44 |
+
10.0% Δp: -1.173%
|
| 45 |
+
5.0% Δp: -2.602%
|
| 46 |
+
1.0% Δp: -6.889%
|
| 47 |
+
0.1% Δp: -17.803%
|
| 48 |
+
Minimum Δp: -88.628%
|
| 49 |
+
RMS Δp : 2.229 ± 0.037 %
|
| 50 |
+
Same top p: 96.672 ± 0.047 %
|
scores/gemma-4-E4B-it-q6_k.tqa
ADDED
|
@@ -0,0 +1,17 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 32 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 8 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 91 tensors
|
| 6 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 7 |
+
llama_model_loader: - type q6_K: 248 tensors
|
| 8 |
+
print_info: file format = GGUF V3 (latest)
|
| 9 |
+
print_info: file type = Q6_K
|
| 10 |
+
print_info: file size = 5.69 GiB (6.50 BPW)
|
| 11 |
+
|
| 12 |
+
multiple_choice_score: there are 817 tasks in prompt
|
| 13 |
+
multiple_choice_score: selecting 750 random tasks from 817 tasks available
|
| 14 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 15 |
+
|
| 16 |
+
Final result: 33.8667 +/- 1.7292
|
| 17 |
+
Random chance: 19.8992 +/- 1.4588
|
scores/gemma-4-E4B-it-q6_k.wng
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q6_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 32 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 8 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 91 tensors
|
| 6 |
+
llama_model_loader: - type q5_K: 2 tensors
|
| 7 |
+
llama_model_loader: - type q6_K: 248 tensors
|
| 8 |
+
print_info: file format = GGUF V3 (latest)
|
| 9 |
+
print_info: file type = Q6_K
|
| 10 |
+
print_info: file size = 5.69 GiB (6.50 BPW)
|
| 11 |
+
|
| 12 |
+
winogrande_score : loaded 1267 tasks from prompt.
|
| 13 |
+
winogrande_score : selecting 750 random tasks
|
| 14 |
+
|
| 15 |
+
Final Winogrande score(750 tasks): 66.5333 +/- 1.7242
|
scores/gemma-4-E4B-it-q7_k.arc
ADDED
|
@@ -0,0 +1,16 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 52 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 1 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 274 tensors
|
| 6 |
+
llama_model_loader: - type q6_K: 54 tensors
|
| 7 |
+
print_info: file format = GGUF V3 (latest)
|
| 8 |
+
print_info: file type = Q8_0
|
| 9 |
+
print_info: file size = 6.56 GiB (7.50 BPW)
|
| 10 |
+
|
| 11 |
+
multiple_choice_score: there are 869 tasks in prompt
|
| 12 |
+
multiple_choice_score: selecting 750 random tasks from 869 tasks available
|
| 13 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 14 |
+
|
| 15 |
+
Final result: 57.2000 +/- 1.8079
|
| 16 |
+
Random chance: 25.0083 +/- 1.5824
|
scores/gemma-4-E4B-it-q7_k.hsw
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 52 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 1 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 274 tensors
|
| 6 |
+
llama_model_loader: - type q6_K: 54 tensors
|
| 7 |
+
print_info: file format = GGUF V3 (latest)
|
| 8 |
+
print_info: file type = Q8_0
|
| 9 |
+
print_info: file size = 6.56 GiB (7.50 BPW)
|
| 10 |
+
|
| 11 |
+
hellaswag_score : loaded 10042 tasks from prompt.
|
| 12 |
+
hellaswag_score : selecting 750 randomized tasks.
|
| 13 |
+
hellaswag_score : calculating hellaswag score over selected tasks.
|
| 14 |
+
|
| 15 |
+
750 68.00000000% [64.5771%, 71.2395%]
|
scores/gemma-4-E4B-it-q7_k.mmlu
ADDED
|
@@ -0,0 +1,16 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 52 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 1 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 274 tensors
|
| 6 |
+
llama_model_loader: - type q6_K: 54 tensors
|
| 7 |
+
print_info: file format = GGUF V3 (latest)
|
| 8 |
+
print_info: file type = Q8_0
|
| 9 |
+
print_info: file size = 6.56 GiB (7.50 BPW)
|
| 10 |
+
|
| 11 |
+
multiple_choice_score: there are 5362 tasks in prompt
|
| 12 |
+
multiple_choice_score: selecting 750 random tasks from 5362 tasks available
|
| 13 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 14 |
+
|
| 15 |
+
Final result: 66.5333 +/- 1.7242
|
| 16 |
+
Random chance: 25.0000 +/- 1.5822
|
scores/gemma-4-E4B-it-q7_k.ppx
ADDED
|
@@ -0,0 +1,49 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 52 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 1 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 274 tensors
|
| 6 |
+
llama_model_loader: - type q6_K: 54 tensors
|
| 7 |
+
print_info: file format = GGUF V3 (latest)
|
| 8 |
+
print_info: file type = Q8_0
|
| 9 |
+
print_info: file size = 6.56 GiB (7.50 BPW)
|
| 10 |
+
|
| 11 |
+
====== Perplexity statistics ======
|
| 12 |
+
Mean PPL(Q) : 57.909227 ± 0.717870
|
| 13 |
+
Mean PPL(base) : 52.693235 ± 0.610088
|
| 14 |
+
Cor(ln(PPL(Q)), ln(PPL(base))): 98.55%
|
| 15 |
+
Mean ln(PPL(Q)/PPL(base)) : 0.094390 ± 0.002196
|
| 16 |
+
Mean PPL(Q)/PPL(base) : 1.098988 ± 0.002413
|
| 17 |
+
Mean PPL(Q)-PPL(base) : 5.215993 ± 0.155827
|
| 18 |
+
|
| 19 |
+
====== KL divergence statistics ======
|
| 20 |
+
Mean KLD: 0.003237 ± 0.000086
|
| 21 |
+
Maximum KLD: 8.411139
|
| 22 |
+
99.9% KLD: 0.152386
|
| 23 |
+
99.0% KLD: 0.029975
|
| 24 |
+
95.0% KLD: 0.010175
|
| 25 |
+
90.0% KLD: 0.006270
|
| 26 |
+
Median KLD: 0.000917
|
| 27 |
+
10.0% KLD: 0.000005
|
| 28 |
+
5.0% KLD: 0.000001
|
| 29 |
+
1.0% KLD: -0.000001
|
| 30 |
+
0.1% KLD: -0.000006
|
| 31 |
+
Minimum KLD: -0.000048
|
| 32 |
+
|
| 33 |
+
====== Token probability statistics ======
|
| 34 |
+
Mean Δp: -0.062 ± 0.004 %
|
| 35 |
+
Maximum Δp: 74.921%
|
| 36 |
+
99.9% Δp: 10.826%
|
| 37 |
+
99.0% Δp: 4.042%
|
| 38 |
+
95.0% Δp: 1.411%
|
| 39 |
+
90.0% Δp: 0.565%
|
| 40 |
+
75.0% Δp: 0.027%
|
| 41 |
+
Median Δp: -0.000%
|
| 42 |
+
25.0% Δp: -0.072%
|
| 43 |
+
10.0% Δp: -0.796%
|
| 44 |
+
5.0% Δp: -1.764%
|
| 45 |
+
1.0% Δp: -4.686%
|
| 46 |
+
0.1% Δp: -11.661%
|
| 47 |
+
Minimum Δp: -87.893%
|
| 48 |
+
RMS Δp : 1.534 ± 0.034 %
|
| 49 |
+
Same top p: 97.743 ± 0.039 %
|
scores/gemma-4-E4B-it-q7_k.tqa
ADDED
|
@@ -0,0 +1,16 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 52 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 1 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 274 tensors
|
| 6 |
+
llama_model_loader: - type q6_K: 54 tensors
|
| 7 |
+
print_info: file format = GGUF V3 (latest)
|
| 8 |
+
print_info: file type = Q8_0
|
| 9 |
+
print_info: file size = 6.56 GiB (7.50 BPW)
|
| 10 |
+
|
| 11 |
+
multiple_choice_score: there are 817 tasks in prompt
|
| 12 |
+
multiple_choice_score: selecting 750 random tasks from 817 tasks available
|
| 13 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 14 |
+
|
| 15 |
+
Final result: 33.7333 +/- 1.7276
|
| 16 |
+
Random chance: 19.8992 +/- 1.4588
|
scores/gemma-4-E4B-it-q7_k.wng
ADDED
|
@@ -0,0 +1,14 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q7_K.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 52 tensors
|
| 4 |
+
llama_model_loader: - type q5_1: 1 tensors
|
| 5 |
+
llama_model_loader: - type q8_0: 274 tensors
|
| 6 |
+
llama_model_loader: - type q6_K: 54 tensors
|
| 7 |
+
print_info: file format = GGUF V3 (latest)
|
| 8 |
+
print_info: file type = Q8_0
|
| 9 |
+
print_info: file size = 6.56 GiB (7.50 BPW)
|
| 10 |
+
|
| 11 |
+
winogrande_score : loaded 1267 tasks from prompt.
|
| 12 |
+
winogrande_score : selecting 750 random tasks
|
| 13 |
+
|
| 14 |
+
Final Winogrande score(750 tasks): 66.6667 +/- 1.7225
|
scores/gemma-4-E4B-it-q8_0.arc
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 60 tensors
|
| 4 |
+
llama_model_loader: - type q8_0: 309 tensors
|
| 5 |
+
llama_model_loader: - type q6_K: 12 tensors
|
| 6 |
+
print_info: file format = GGUF V3 (latest)
|
| 7 |
+
print_info: file type = Q8_0
|
| 8 |
+
print_info: file size = 7.44 GiB (8.50 BPW)
|
| 9 |
+
|
| 10 |
+
multiple_choice_score: there are 869 tasks in prompt
|
| 11 |
+
multiple_choice_score: selecting 750 random tasks from 869 tasks available
|
| 12 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 13 |
+
|
| 14 |
+
Final result: 56.9333 +/- 1.8093
|
| 15 |
+
Random chance: 25.0083 +/- 1.5824
|
scores/gemma-4-E4B-it-q8_0.hsw
ADDED
|
@@ -0,0 +1,14 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 60 tensors
|
| 4 |
+
llama_model_loader: - type q8_0: 309 tensors
|
| 5 |
+
llama_model_loader: - type q6_K: 12 tensors
|
| 6 |
+
print_info: file format = GGUF V3 (latest)
|
| 7 |
+
print_info: file type = Q8_0
|
| 8 |
+
print_info: file size = 7.44 GiB (8.50 BPW)
|
| 9 |
+
|
| 10 |
+
hellaswag_score : loaded 10042 tasks from prompt.
|
| 11 |
+
hellaswag_score : selecting 750 randomized tasks.
|
| 12 |
+
hellaswag_score : calculating hellaswag score over selected tasks.
|
| 13 |
+
|
| 14 |
+
750 68.00000000% [64.5771%, 71.2395%]
|
scores/gemma-4-E4B-it-q8_0.mmlu
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 60 tensors
|
| 4 |
+
llama_model_loader: - type q8_0: 309 tensors
|
| 5 |
+
llama_model_loader: - type q6_K: 12 tensors
|
| 6 |
+
print_info: file format = GGUF V3 (latest)
|
| 7 |
+
print_info: file type = Q8_0
|
| 8 |
+
print_info: file size = 7.44 GiB (8.50 BPW)
|
| 9 |
+
|
| 10 |
+
multiple_choice_score: there are 5362 tasks in prompt
|
| 11 |
+
multiple_choice_score: selecting 750 random tasks from 5362 tasks available
|
| 12 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 13 |
+
|
| 14 |
+
Final result: 66.5333 +/- 1.7242
|
| 15 |
+
Random chance: 25.0000 +/- 1.5822
|
scores/gemma-4-E4B-it-q8_0.ppx
ADDED
|
@@ -0,0 +1,48 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 60 tensors
|
| 4 |
+
llama_model_loader: - type q8_0: 309 tensors
|
| 5 |
+
llama_model_loader: - type q6_K: 12 tensors
|
| 6 |
+
print_info: file format = GGUF V3 (latest)
|
| 7 |
+
print_info: file type = Q8_0
|
| 8 |
+
print_info: file size = 7.44 GiB (8.50 BPW)
|
| 9 |
+
|
| 10 |
+
====== Perplexity statistics ======
|
| 11 |
+
Mean PPL(Q) : 57.324375 ± 0.708968
|
| 12 |
+
Mean PPL(base) : 52.693235 ± 0.610088
|
| 13 |
+
Cor(ln(PPL(Q)), ln(PPL(base))): 98.58%
|
| 14 |
+
Mean ln(PPL(Q)/PPL(base)) : 0.084239 ± 0.002164
|
| 15 |
+
Mean PPL(Q)/PPL(base) : 1.087889 ± 0.002354
|
| 16 |
+
Mean PPL(Q)-PPL(base) : 4.631141 ± 0.148444
|
| 17 |
+
|
| 18 |
+
====== KL divergence statistics ======
|
| 19 |
+
Mean KLD: 0.001798 ± 0.000059
|
| 20 |
+
Maximum KLD: 4.473496
|
| 21 |
+
99.9% KLD: 0.106441
|
| 22 |
+
99.0% KLD: 0.015963
|
| 23 |
+
95.0% KLD: 0.005257
|
| 24 |
+
90.0% KLD: 0.003187
|
| 25 |
+
Median KLD: 0.000441
|
| 26 |
+
10.0% KLD: 0.000003
|
| 27 |
+
5.0% KLD: 0.000000
|
| 28 |
+
1.0% KLD: -0.000001
|
| 29 |
+
0.1% KLD: -0.000007
|
| 30 |
+
Minimum KLD: -0.000047
|
| 31 |
+
|
| 32 |
+
====== Token probability statistics ======
|
| 33 |
+
Mean Δp: -0.020 ± 0.003 %
|
| 34 |
+
Maximum Δp: 71.373%
|
| 35 |
+
99.9% Δp: 8.424%
|
| 36 |
+
99.0% Δp: 3.038%
|
| 37 |
+
95.0% Δp: 1.051%
|
| 38 |
+
90.0% Δp: 0.443%
|
| 39 |
+
75.0% Δp: 0.026%
|
| 40 |
+
Median Δp: -0.000%
|
| 41 |
+
25.0% Δp: -0.037%
|
| 42 |
+
10.0% Δp: -0.510%
|
| 43 |
+
5.0% Δp: -1.171%
|
| 44 |
+
1.0% Δp: -3.218%
|
| 45 |
+
0.1% Δp: -8.574%
|
| 46 |
+
Minimum Δp: -88.102%
|
| 47 |
+
RMS Δp : 1.155 ± 0.038 %
|
| 48 |
+
Same top p: 98.371 ± 0.033 %
|
scores/gemma-4-E4B-it-q8_0.tqa
ADDED
|
@@ -0,0 +1,15 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 60 tensors
|
| 4 |
+
llama_model_loader: - type q8_0: 309 tensors
|
| 5 |
+
llama_model_loader: - type q6_K: 12 tensors
|
| 6 |
+
print_info: file format = GGUF V3 (latest)
|
| 7 |
+
print_info: file type = Q8_0
|
| 8 |
+
print_info: file size = 7.44 GiB (8.50 BPW)
|
| 9 |
+
|
| 10 |
+
multiple_choice_score: there are 817 tasks in prompt
|
| 11 |
+
multiple_choice_score: selecting 750 random tasks from 817 tasks available
|
| 12 |
+
multiple_choice_score : calculating TruthfulQA score over 750 tasks.
|
| 13 |
+
|
| 14 |
+
Final result: 34.0000 +/- 1.7309
|
| 15 |
+
Random chance: 19.8992 +/- 1.4588
|
scores/gemma-4-E4B-it-q8_0.wng
ADDED
|
@@ -0,0 +1,13 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q8_0.gguf (version GGUF V3 (latest))
|
| 2 |
+
llama_model_loader: - type f32: 339 tensors
|
| 3 |
+
llama_model_loader: - type f16: 60 tensors
|
| 4 |
+
llama_model_loader: - type q8_0: 309 tensors
|
| 5 |
+
llama_model_loader: - type q6_K: 12 tensors
|
| 6 |
+
print_info: file format = GGUF V3 (latest)
|
| 7 |
+
print_info: file type = Q8_0
|
| 8 |
+
print_info: file size = 7.44 GiB (8.50 BPW)
|
| 9 |
+
|
| 10 |
+
winogrande_score : loaded 1267 tasks from prompt.
|
| 11 |
+
winogrande_score : selecting 750 random tasks
|
| 12 |
+
|
| 13 |
+
Final Winogrande score(750 tasks): 67.0667 +/- 1.7172
|