{ "train_loss": 0.2654730905127782, "train_runtime_seconds": 1325.9341, "config": { "model": "Qwen/Qwen3.5-9B", "lora_r": 16, "lora_alpha": 32, "max_seq_length": 8000, "batch_size": 1, "grad_accum": 16, "lr": 0.0002, "epochs": 3, "quantization": "4bit", "framework": "unsloth", "enable_thinking": false, "train_samples": 980, "data_version": "v3 (label leakage removed, balanced 490:490)" } }