lol-loracle-v3 / README.md
ceselder's picture
Upload README.md with huggingface_hub
77222d1 verified
|
Raw
History Blame Contribute Delete
1.03 kB
metadata
library_name: peft
base_model: Qwen/Qwen3-14B
tags:
  - loracle
  - lora
  - lots-of-loras
  - weight-reading

LoL LoRAcle v3 (2-Q + fineweb mix)

Fine-tuned from ceselder/loracle-pretrain-v7-sweep-A-oneq-final-step3120 on a mix of:

Full training corpus: ceselder/lol-loracle-qa-v3-mix.

Training

  • 3256 train items, 80 eval (40 LoL holdout × 2 Q/A), 407 steps, lr=1e-5 linear, grad_accum=8
  • val_loss: 2.4669 (step 0, v7 baseline) -> 1.3391 (step 407, final)
  • Cross-LoRA: matched=1.2429, crossed=1.6747 (gap=0.4319) -- loracle conditions strongly on direction tokens
  • wandb: https://wandb.ai/adamkarvonen/lora-oracles/runs/ml9vulke