gemma-4-12B-it-W4A16-AutoRound-AWQ / quantization_config.json
Vishva007's picture
Upload folder using huggingface_hub
bb42774 verified
Raw
History Blame Contribute Delete
512 Bytes
{
"bits": 4,
"data_type": "int",
"group_size": 128,
"sym": true,
"enable_quanted_input": false,
"nsamples": 256,
"to_quant_block_names": "model.language_model.layers",
"autoround_version": "0.14.0",
"provider": "auto-round",
"quant_method": "awq",
"zero_point": false,
"version": "gemm",
"modules_to_not_convert": [
"model.embed_vision.multimodal_embedder.embedding_projection",
"model.embed_audio.embedding_projection",
"model.embed_vision.patch_dense",
"lm_head"
]
}