Qwen3.6-27B LoRA — Single Modal, Cluster 0

This model is a LoRA fine-tune of Qwen/Qwen3.6-27B as part of the AIML589 project.

This adapter is licensed under CC BY-SA 4.0.

Dataset

Fine-tuned on the single_modal config of the wvs-nz-value-alignment dataset, cluster_0 subpopulation.

Part of the wvs-nz-value-alignment collection.

GPU: NVIDIA RTX PRO 6000 Blackwell Workstation Edition · Training time: 55m 18s

Training hyperparameters

Parameter Value
LoRA rank 256
LoRA alpha 512
LoRA dropout 0.05
DoRA False
Learning rate 0.0002
Batch size 4
Gradient accumulation 4
Epochs 10
Max seq length 1024
Warmup ratio 0.1
Dtype bf16

Training log

{"loss": 2.3350702285766602, "grad_norm": 2.126115083694458, "learning_rate": 2.4e-05, "entropy": 0.9845020145177841, "mean_token_accuracy": 0.5560477688908577, "num_tokens": 25908.0, "epoch": 0.13377926421404682, "step": 10}
{"loss": 0.3779462337493896, "grad_norm": 1.9926918745040894, "learning_rate": 5.0666666666666674e-05, "entropy": 0.3982837896794081, "mean_token_accuracy": 0.9054551899433136, "num_tokens": 52070.0, "epoch": 0.26755852842809363, "step": 20}
{"loss": 0.16925137042999266, "grad_norm": 0.48601362109184265, "learning_rate": 7.733333333333333e-05, "entropy": 0.1727235957980156, "mean_token_accuracy": 0.9523847907781601, "num_tokens": 78409.0, "epoch": 0.4013377926421405, "step": 30}
{"loss": 0.10036897659301758, "grad_norm": 0.3011629283428192, "learning_rate": 0.00010400000000000001, "entropy": 0.10287642031908036, "mean_token_accuracy": 0.970121155679226, "num_tokens": 104416.0, "epoch": 0.5351170568561873, "step": 40}
{"loss": 0.09868849515914917, "grad_norm": 0.3935889005661011, "learning_rate": 0.00013066666666666668, "entropy": 0.09777253782376646, "mean_token_accuracy": 0.9710110872983932, "num_tokens": 130829.0, "epoch": 0.6688963210702341, "step": 50}
{"loss": 0.09276055097579956, "grad_norm": 0.42091768980026245, "learning_rate": 0.00015733333333333333, "entropy": 0.09038980640470981, "mean_token_accuracy": 0.9708655625581741, "num_tokens": 156584.0, "epoch": 0.802675585284281, "step": 60}
{"loss": 0.07530102133750916, "grad_norm": 0.3683886229991913, "learning_rate": 0.00018400000000000003, "entropy": 0.07350968066602945, "mean_token_accuracy": 0.976312330365181, "num_tokens": 182776.0, "epoch": 0.9364548494983278, "step": 70}
{"loss": 0.0847815752029419, "grad_norm": 0.5596132874488831, "learning_rate": 0.00019881481481481483, "entropy": 0.07552582894762357, "mean_token_accuracy": 0.974776029586792, "num_tokens": 208711.0, "epoch": 1.0668896321070234, "step": 80}
{"loss": 0.07142020463943481, "grad_norm": 0.30593767762184143, "learning_rate": 0.00019585185185185187, "entropy": 0.07362747341394424, "mean_token_accuracy": 0.9764504462480545, "num_tokens": 234821.0, "epoch": 1.2006688963210703, "step": 90}
{"loss": 0.07483839988708496, "grad_norm": 0.3288325071334839, "learning_rate": 0.0001928888888888889, "entropy": 0.07482073614373803, "mean_token_accuracy": 0.9761045679450036, "num_tokens": 261249.0, "epoch": 1.334448160535117, "step": 100}
{"loss": 0.0659669816493988, "grad_norm": 0.3445797264575958, "learning_rate": 0.00018992592592592593, "entropy": 0.06356935771182179, "mean_token_accuracy": 0.9778561517596245, "num_tokens": 287400.0, "epoch": 1.468227424749164, "step": 110}
{"loss": 0.06567960977554321, "grad_norm": 0.13449490070343018, "learning_rate": 0.00018696296296296297, "entropy": 0.06592689622193575, "mean_token_accuracy": 0.9779328182339668, "num_tokens": 313368.0, "epoch": 1.6020066889632107, "step": 120}
{"loss": 0.057089966535568235, "grad_norm": 0.20653440058231354, "learning_rate": 0.00018400000000000003, "entropy": 0.05499814851209521, "mean_token_accuracy": 0.9799689143896103, "num_tokens": 340032.0, "epoch": 1.7357859531772575, "step": 130}
{"loss": 0.059308451414108274, "grad_norm": 0.3236748278141022, "learning_rate": 0.00018103703703703706, "entropy": 0.060764652024954555, "mean_token_accuracy": 0.9786995187401771, "num_tokens": 365853.0, "epoch": 1.8695652173913042, "step": 140}
{"loss": 0.05960685610771179, "grad_norm": 0.26129579544067383, "learning_rate": 0.0001780740740740741, "entropy": 0.05582101690845612, "mean_token_accuracy": 0.9782811021193479, "num_tokens": 390718.0, "epoch": 2.0, "step": 150}
{"loss": 0.06768396496772766, "grad_norm": 0.2607591450214386, "learning_rate": 0.00017511111111111113, "entropy": 0.06340908287093043, "mean_token_accuracy": 0.9781398087739944, "num_tokens": 416817.0, "epoch": 2.1337792642140467, "step": 160}
{"loss": 0.06357197165489196, "grad_norm": 0.36085760593414307, "learning_rate": 0.00017214814814814816, "entropy": 0.0579464758746326, "mean_token_accuracy": 0.9781716257333756, "num_tokens": 443300.0, "epoch": 2.2675585284280935, "step": 170}
{"loss": 0.06149377822875977, "grad_norm": 0.21101389825344086, "learning_rate": 0.0001691851851851852, "entropy": 0.06474902424961329, "mean_token_accuracy": 0.9778162553906441, "num_tokens": 469368.0, "epoch": 2.4013377926421406, "step": 180}
{"loss": 0.054176777601242065, "grad_norm": 0.20767132937908173, "learning_rate": 0.00016622222222222223, "entropy": 0.05191241558641195, "mean_token_accuracy": 0.9800843000411987, "num_tokens": 495808.0, "epoch": 2.5351170568561874, "step": 190}
{"loss": 0.0928359568119049, "grad_norm": 4.008718967437744, "learning_rate": 0.00016325925925925926, "entropy": 0.07059445073828101, "mean_token_accuracy": 0.9764466315507889, "num_tokens": 521928.0, "epoch": 2.668896321070234, "step": 200}
{"loss": 0.17444621324539183, "grad_norm": 5.664956569671631, "learning_rate": 0.0001602962962962963, "entropy": 0.15803412850946189, "mean_token_accuracy": 0.9556752011179924, "num_tokens": 547783.0, "epoch": 2.802675585284281, "step": 210}
{"loss": 0.12244393825531005, "grad_norm": 6.493709564208984, "learning_rate": 0.00015733333333333333, "entropy": 0.10503043662756681, "mean_token_accuracy": 0.9650098189711571, "num_tokens": 573864.0, "epoch": 2.936454849498328, "step": 220}
{"loss": 0.2584514617919922, "grad_norm": 2.1155190467834473, "learning_rate": 0.0001543703703703704, "entropy": 0.20088590318575883, "mean_token_accuracy": 0.9457573004257984, "num_tokens": 599271.0, "epoch": 3.0668896321070234, "step": 230}
{"loss": 0.12478911876678467, "grad_norm": 17.318798065185547, "learning_rate": 0.00015140740740740742, "entropy": 0.1077444264665246, "mean_token_accuracy": 0.9664437159895897, "num_tokens": 625578.0, "epoch": 3.20066889632107, "step": 240}
{"loss": 0.06641613841056823, "grad_norm": 0.6083024144172668, "learning_rate": 0.00014844444444444445, "entropy": 0.07435562135651708, "mean_token_accuracy": 0.9770139724016189, "num_tokens": 651363.0, "epoch": 3.334448160535117, "step": 250}
{"loss": 0.05701074004173279, "grad_norm": 0.16113755106925964, "learning_rate": 0.0001454814814814815, "entropy": 0.05574525967240333, "mean_token_accuracy": 0.9788861036300659, "num_tokens": 677852.0, "epoch": 3.468227424749164, "step": 260}
{"loss": 0.054770642518997194, "grad_norm": 0.13629816472530365, "learning_rate": 0.00014251851851851852, "entropy": 0.05147901671007275, "mean_token_accuracy": 0.9797735244035721, "num_tokens": 703903.0, "epoch": 3.6020066889632107, "step": 270}
{"loss": 0.051657623052597045, "grad_norm": 0.08839844912290573, "learning_rate": 0.00013955555555555558, "entropy": 0.05364155145362019, "mean_token_accuracy": 0.981257289648056, "num_tokens": 730309.0, "epoch": 3.7357859531772575, "step": 280}
{"loss": 0.071628737449646, "grad_norm": 1.743930697441101, "learning_rate": 0.00013659259259259261, "entropy": 0.0562255091033876, "mean_token_accuracy": 0.9782400459051133, "num_tokens": 756238.0, "epoch": 3.869565217391304, "step": 290}
{"loss": 0.05360655784606934, "grad_norm": 0.25600770115852356, "learning_rate": 0.00013362962962962965, "entropy": 0.060838825427568875, "mean_token_accuracy": 0.9805979178502009, "num_tokens": 781436.0, "epoch": 4.0, "step": 300}
{"loss": 0.04998879432678223, "grad_norm": 0.20228563249111176, "learning_rate": 0.00013066666666666668, "entropy": 0.049327085725963116, "mean_token_accuracy": 0.9814881607890129, "num_tokens": 807953.0, "epoch": 4.133779264214047, "step": 310}
{"loss": 0.050491231679916385, "grad_norm": 0.09149721264839172, "learning_rate": 0.00012770370370370371, "entropy": 0.050593612063676116, "mean_token_accuracy": 0.9808845669031143, "num_tokens": 834163.0, "epoch": 4.2675585284280935, "step": 320}
{"loss": 0.04812803268432617, "grad_norm": 0.05943567305803299, "learning_rate": 0.00012474074074074075, "entropy": 0.051357141323387624, "mean_token_accuracy": 0.9814439088106155, "num_tokens": 860284.0, "epoch": 4.40133779264214, "step": 330}
{"loss": 0.05003845691680908, "grad_norm": 0.0666387602686882, "learning_rate": 0.0001217777777777778, "entropy": 0.04815329574048519, "mean_token_accuracy": 0.9807070747017861, "num_tokens": 886227.0, "epoch": 4.535117056856187, "step": 340}
{"loss": 0.049336501955986024, "grad_norm": 0.061376795172691345, "learning_rate": 0.00011881481481481483, "entropy": 0.04918608497828245, "mean_token_accuracy": 0.9806731939315796, "num_tokens": 912147.0, "epoch": 4.668896321070234, "step": 350}
{"loss": 0.04782525897026062, "grad_norm": 0.06473014503717422, "learning_rate": 0.00011585185185185186, "entropy": 0.04786741100251675, "mean_token_accuracy": 0.9816080316901207, "num_tokens": 938391.0, "epoch": 4.802675585284281, "step": 360}
{"loss": 0.04704303741455078, "grad_norm": 0.05789949372410774, "learning_rate": 0.0001128888888888889, "entropy": 0.04768284372985363, "mean_token_accuracy": 0.9813039109110833, "num_tokens": 964652.0, "epoch": 4.936454849498328, "step": 370}
{"loss": 0.047152957320213316, "grad_norm": 0.0516776442527771, "learning_rate": 0.00010992592592592593, "entropy": 0.04725002984587963, "mean_token_accuracy": 0.9817198637204293, "num_tokens": 989767.0, "epoch": 5.066889632107023, "step": 380}
{"loss": 0.04631853699684143, "grad_norm": 0.09096135944128036, "learning_rate": 0.00010696296296296297, "entropy": 0.044959074817597866, "mean_token_accuracy": 0.9824024409055709, "num_tokens": 1016396.0, "epoch": 5.20066889632107, "step": 390}
{"loss": 0.04671220183372497, "grad_norm": 0.04908112809062004, "learning_rate": 0.00010400000000000001, "entropy": 0.04717921065166593, "mean_token_accuracy": 0.9809752717614174, "num_tokens": 1042559.0, "epoch": 5.334448160535117, "step": 400}
{"loss": 0.04706255197525024, "grad_norm": 0.056100476533174515, "learning_rate": 0.00010103703703703704, "entropy": 0.046549116354435684, "mean_token_accuracy": 0.9816643714904785, "num_tokens": 1068448.0, "epoch": 5.468227424749164, "step": 410}
{"loss": 0.04695602655410767, "grad_norm": 0.0726035088300705, "learning_rate": 9.807407407407407e-05, "entropy": 0.04671499002724886, "mean_token_accuracy": 0.9821092322468757, "num_tokens": 1094667.0, "epoch": 5.602006688963211, "step": 420}
{"loss": 0.046052473783493045, "grad_norm": 0.05500998720526695, "learning_rate": 9.511111111111112e-05, "entropy": 0.04537281524389982, "mean_token_accuracy": 0.9820035189390183, "num_tokens": 1120997.0, "epoch": 5.735785953177258, "step": 430}
{"loss": 0.045960599184036256, "grad_norm": 0.051139235496520996, "learning_rate": 9.214814814814815e-05, "entropy": 0.04726616600528359, "mean_token_accuracy": 0.9825124740600586, "num_tokens": 1147418.0, "epoch": 5.869565217391305, "step": 440}
{"loss": 0.04764716029167175, "grad_norm": 0.0681043490767479, "learning_rate": 8.918518518518519e-05, "entropy": 0.04796074206630389, "mean_token_accuracy": 0.9813224291190122, "num_tokens": 1172154.0, "epoch": 6.0, "step": 450}
{"loss": 0.044545361399650575, "grad_norm": 0.04411068931221962, "learning_rate": 8.622222222222222e-05, "entropy": 0.04484714604914188, "mean_token_accuracy": 0.9833428040146828, "num_tokens": 1198422.0, "epoch": 6.133779264214047, "step": 460}
{"loss": 0.044630637764930724, "grad_norm": 0.044218968600034714, "learning_rate": 8.325925925925925e-05, "entropy": 0.04379510534927249, "mean_token_accuracy": 0.9817589163780213, "num_tokens": 1225223.0, "epoch": 6.2675585284280935, "step": 470}
{"loss": 0.04621260166168213, "grad_norm": 0.045542433857917786, "learning_rate": 8.02962962962963e-05, "entropy": 0.04544634558260441, "mean_token_accuracy": 0.980923168361187, "num_tokens": 1251138.0, "epoch": 6.40133779264214, "step": 480}
{"loss": 0.045143145322799685, "grad_norm": 0.045879289507865906, "learning_rate": 7.733333333333333e-05, "entropy": 0.04558473052456975, "mean_token_accuracy": 0.9830675959587097, "num_tokens": 1277778.0, "epoch": 6.535117056856187, "step": 490}
{"loss": 0.04580670297145843, "grad_norm": 0.053280703723430634, "learning_rate": 7.437037037037038e-05, "entropy": 0.04622430605813861, "mean_token_accuracy": 0.9817850425839424, "num_tokens": 1304149.0, "epoch": 6.668896321070234, "step": 500}
{"loss": 0.04614096283912659, "grad_norm": 0.04036270081996918, "learning_rate": 7.140740740740741e-05, "entropy": 0.04787801885977387, "mean_token_accuracy": 0.9816120103001594, "num_tokens": 1330003.0, "epoch": 6.802675585284281, "step": 510}
{"loss": 0.04712030291557312, "grad_norm": 0.05030002072453499, "learning_rate": 6.844444444444445e-05, "entropy": 0.045525189489126205, "mean_token_accuracy": 0.9806056469678879, "num_tokens": 1355587.0, "epoch": 6.936454849498328, "step": 520}
{"loss": 0.04524389207363129, "grad_norm": 0.053240351378917694, "learning_rate": 6.54814814814815e-05, "entropy": 0.046274297894575656, "mean_token_accuracy": 0.9824024943205026, "num_tokens": 1380675.0, "epoch": 7.066889632107023, "step": 530}
{"loss": 0.04606519043445587, "grad_norm": 0.06292477250099182, "learning_rate": 6.251851851851853e-05, "entropy": 0.04700453681871295, "mean_token_accuracy": 0.98181983679533, "num_tokens": 1406169.0, "epoch": 7.20066889632107, "step": 540}
{"loss": 0.04500005543231964, "grad_norm": 0.04238612577319145, "learning_rate": 5.9555555555555554e-05, "entropy": 0.043744641821831465, "mean_token_accuracy": 0.9827116459608078, "num_tokens": 1432664.0, "epoch": 7.334448160535117, "step": 550}
{"loss": 0.044475018978118896, "grad_norm": 0.03786426782608032, "learning_rate": 5.6592592592592594e-05, "entropy": 0.04434294030070305, "mean_token_accuracy": 0.982609598338604, "num_tokens": 1459087.0, "epoch": 7.468227424749164, "step": 560}
{"loss": 0.04571772515773773, "grad_norm": 0.039601076394319534, "learning_rate": 5.362962962962963e-05, "entropy": 0.04578504553064704, "mean_token_accuracy": 0.9812598288059234, "num_tokens": 1485203.0, "epoch": 7.602006688963211, "step": 570}
{"loss": 0.045766600966453554, "grad_norm": 0.04519850015640259, "learning_rate": 5.0666666666666674e-05, "entropy": 0.046260463818907735, "mean_token_accuracy": 0.9812280714511872, "num_tokens": 1511112.0, "epoch": 7.735785953177258, "step": 580}
{"loss": 0.045879656076431276, "grad_norm": 0.04756087809801102, "learning_rate": 4.770370370370371e-05, "entropy": 0.045524066966027024, "mean_token_accuracy": 0.9813782453536988, "num_tokens": 1537025.0, "epoch": 7.869565217391305, "step": 590}
{"loss": 0.04452150762081146, "grad_norm": 0.04454594478011131, "learning_rate": 4.474074074074075e-05, "entropy": 0.04385903410804577, "mean_token_accuracy": 0.9813742958582364, "num_tokens": 1562872.0, "epoch": 8.0, "step": 600}
{"loss": 0.04484732151031494, "grad_norm": 0.045541178435087204, "learning_rate": 4.177777777777778e-05, "entropy": 0.046888014487922194, "mean_token_accuracy": 0.9821029022336006, "num_tokens": 1588776.0, "epoch": 8.133779264214047, "step": 610}
{"loss": 0.044346940517425534, "grad_norm": 0.04908062145113945, "learning_rate": 3.8814814814814814e-05, "entropy": 0.04556438699364662, "mean_token_accuracy": 0.9820538386702538, "num_tokens": 1615074.0, "epoch": 8.267558528428093, "step": 620}
{"loss": 0.04478709697723389, "grad_norm": 0.0430021733045578, "learning_rate": 3.5851851851851854e-05, "entropy": 0.04493716303259134, "mean_token_accuracy": 0.9820282936096192, "num_tokens": 1641080.0, "epoch": 8.40133779264214, "step": 630}
{"loss": 0.04450368285179138, "grad_norm": 0.04164363071322441, "learning_rate": 3.2888888888888894e-05, "entropy": 0.04488292783498764, "mean_token_accuracy": 0.9824050948023796, "num_tokens": 1667492.0, "epoch": 8.535117056856187, "step": 640}
{"loss": 0.04430777132511139, "grad_norm": 0.038175348192453384, "learning_rate": 2.992592592592593e-05, "entropy": 0.04474753849208355, "mean_token_accuracy": 0.9822994336485863, "num_tokens": 1693938.0, "epoch": 8.668896321070234, "step": 650}
{"loss": 0.04533534049987793, "grad_norm": 0.038727663457393646, "learning_rate": 2.696296296296296e-05, "entropy": 0.04472546698525548, "mean_token_accuracy": 0.9815646901726722, "num_tokens": 1719866.0, "epoch": 8.80267558528428, "step": 660}
{"loss": 0.044608548283576965, "grad_norm": 0.040943246334791183, "learning_rate": 2.4e-05, "entropy": 0.04405543990433216, "mean_token_accuracy": 0.9825437992811203, "num_tokens": 1746155.0, "epoch": 8.936454849498327, "step": 670}
{"loss": 0.04502744972705841, "grad_norm": 0.03215134143829346, "learning_rate": 2.1037037037037037e-05, "entropy": 0.04519386274310259, "mean_token_accuracy": 0.9817209304907383, "num_tokens": 1771215.0, "epoch": 9.066889632107024, "step": 680}
{"loss": 0.043701156973838806, "grad_norm": 0.038579344749450684, "learning_rate": 1.8074074074074074e-05, "entropy": 0.046587126795202494, "mean_token_accuracy": 0.9826306357979775, "num_tokens": 1797555.0, "epoch": 9.200668896321071, "step": 690}
{"loss": 0.043728145956993106, "grad_norm": 0.035438988357782364, "learning_rate": 1.5111111111111112e-05, "entropy": 0.044238153100013736, "mean_token_accuracy": 0.9828086480498314, "num_tokens": 1823907.0, "epoch": 9.334448160535118, "step": 700}
{"loss": 0.04530455470085144, "grad_norm": 0.038544896990060806, "learning_rate": 1.2148148148148149e-05, "entropy": 0.0445164792239666, "mean_token_accuracy": 0.9812344640493393, "num_tokens": 1849527.0, "epoch": 9.468227424749164, "step": 710}
{"loss": 0.04406244158744812, "grad_norm": 0.03728979080915451, "learning_rate": 9.185185185185186e-06, "entropy": 0.0448289361782372, "mean_token_accuracy": 0.9825592920184135, "num_tokens": 1875802.0, "epoch": 9.602006688963211, "step": 720}
{"loss": 0.044049999117851256, "grad_norm": 0.03935021162033081, "learning_rate": 6.222222222222222e-06, "entropy": 0.045199227146804334, "mean_token_accuracy": 0.9822578102350235, "num_tokens": 1902112.0, "epoch": 9.735785953177258, "step": 730}
{"loss": 0.044008302688598636, "grad_norm": 0.03354469686746597, "learning_rate": 3.259259259259259e-06, "entropy": 0.04438428562134504, "mean_token_accuracy": 0.9823073506355285, "num_tokens": 1928552.0, "epoch": 9.869565217391305, "step": 740}
{"loss": 0.0448079377412796, "grad_norm": 0.04010051116347313, "learning_rate": 2.962962962962963e-07, "entropy": 0.045239492964286074, "mean_token_accuracy": 0.981640528409909, "num_tokens": 1953590.0, "epoch": 10.0, "step": 750}
{"train_runtime": 3318.1146, "train_samples_per_second": 3.601, "train_steps_per_second": 0.226, "total_flos": 3.663031151648563e+17, "train_loss": 0.09639296555519104, "epoch": 10.0, "step": 750}

Environment

Package Version
torch 2.13.0
transformers 5.14.1
trl 1.9.2
datasets 5.0.1
accelerate 1.14.0
python-dotenv 1.2.2
peft 0.20.0
bitsandbytes 0.50.0
huggingface-hub ?
jinja2 ?
torchvision 0.28.0
pillow 12.3.0

Intended use

This adapter is intended for research purposes only as part of the AIML589 project, which investigates value alignment of LLMs with New Zealand population distributions from the World Values Survey.

Out-of-scope

This model has not been safety-tuned for general-purpose deployment. It should not be used in production systems, for making decisions about people, or in contexts where reliability and safety are critical.

Limitations and biases

  • Fine-tuned on a single WVS wave (Wave 7) for New Zealand only.
  • The training data reflects the values of those who responded to the survey and may not represent all New Zealanders.
  • LoRA adapters are subject to the limitations and biases of the base model (Qwen/Qwen3.6-27B).
Downloads last month
13
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for 1jamesthompson1/Qwen3.6-27B-nz-wvs-single_modal-cluster_0

Base model

Qwen/Qwen3.6-27B
Adapter
(424)
this model

Dataset used to train 1jamesthompson1/Qwen3.6-27B-nz-wvs-single_modal-cluster_0

Collection including 1jamesthompson1/Qwen3.6-27B-nz-wvs-single_modal-cluster_0