--- library_name: transformers base_model: - Qwen/Qwen3-4B-Thinking-2507 base_model_relation: quantized pipeline_tag: text-generation tags: - Qwen3 - AWQ - W4A16 - llm-compressor --- # Qwen3-4B-Thinking-2507-llmc-awq-calib-ultrachat-200k-train-sft-w4a16-g128-n256-s1024 Base model: `Qwen/Qwen3-4B-Thinking-2507` Quantized with `llm-compressor`. - method: `awq` - weight format: `W4A16` - group size: `128` - calibration dataset: `HuggingFaceH4/ultrachat_200k` - calibration dataset config: `` - calibration split: `train_sft` - calibration samples: `256` - max sequence length: `1024`