{ "model_name": "Qwen/Qwen3-VL-8B-Thinking", "response_template": "<|im_start|>assistant\n", "dataset": "src/honesty_finetuning/data/followup_split_personality_chat.jsonl", "dataset2": null, "num_samples": 10000, "epochs": 3, "batch_size": 4, "grad_accum": 4, "lr": 0.0001, "max_seq_length": 1024, "warmup_steps": 5, "save_steps": 1000, "lora_r": 32, "lora_alpha": 64 }