llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q3_K.gguf (version GGUF V3 (latest)) llama_model_loader: - type f32: 339 tensors llama_model_loader: - type f16: 1 tensors llama_model_loader: - type q4_1: 11 tensors llama_model_loader: - type q5_1: 6 tensors llama_model_loader: - type q8_0: 1 tensors llama_model_loader: - type q2_K: 11 tensors llama_model_loader: - type q3_K: 118 tensors llama_model_loader: - type q4_K: 41 tensors llama_model_loader: - type q5_K: 6 tensors llama_model_loader: - type iq3_xxs: 41 tensors llama_model_loader: - type iq3_s: 49 tensors llama_model_loader: - type iq4_xs: 96 tensors print_info: file format = GGUF V3 (latest) print_info: file type = IQ4_XS - 4.25 bpw print_info: file size = 3.06 GiB (3.50 BPW) multiple_choice_score: there are 869 tasks in prompt multiple_choice_score: selecting 750 random tasks from 869 tasks available multiple_choice_score : calculating TruthfulQA score over 750 tasks. Final result: 54.0000 +/- 1.8211 Random chance: 25.0083 +/- 1.5824