llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q4_K.gguf (version GGUF V3 (latest)) llama_model_loader: - type f32: 339 tensors llama_model_loader: - type f16: 2 tensors llama_model_loader: - type q4_1: 5 tensors llama_model_loader: - type q5_1: 24 tensors llama_model_loader: - type q8_0: 2 tensors llama_model_loader: - type q3_K: 1 tensors llama_model_loader: - type q4_K: 95 tensors llama_model_loader: - type q5_K: 101 tensors llama_model_loader: - type q6_K: 2 tensors llama_model_loader: - type iq4_xs: 149 tensors print_info: file format = GGUF V3 (latest) print_info: file type = Q4_K - Medium print_info: file size = 3.94 GiB (4.50 BPW) hellaswag_score : loaded 10042 tasks from prompt. hellaswag_score : selecting 750 randomized tasks. hellaswag_score : calculating hellaswag score over selected tasks. 750 66.66666667% [63.2155%, 69.9479%]