llama_model_loader: loaded meta data with 49 key-value pairs and 720 tensors from gemma-4-E4B-it-WIP/gemma-4-E4B-it-Q2_K.gguf (version GGUF V3 (latest)) llama_model_loader: - type f32: 339 tensors llama_model_loader: - type f16: 1 tensors llama_model_loader: - type q4_1: 7 tensors llama_model_loader: - type q2_K: 112 tensors llama_model_loader: - type q3_K: 36 tensors llama_model_loader: - type q4_K: 15 tensors llama_model_loader: - type q5_K: 2 tensors llama_model_loader: - type iq2_xxs: 94 tensors llama_model_loader: - type iq2_xs: 38 tensors llama_model_loader: - type iq3_xxs: 38 tensors llama_model_loader: - type iq4_xs: 2 tensors llama_model_loader: - type iq1_m: 36 tensors print_info: file format = GGUF V3 (latest) print_info: file type = IQ2_S - 2.5 bpw print_info: file size = 2.19 GiB (2.50 BPW) hellaswag_score : loaded 10042 tasks from prompt. hellaswag_score : selecting 750 randomized tasks. hellaswag_score : calculating hellaswag score over selected tasks. 750 42.53333333% [39.0419%, 46.1008%]