AlessaC commited on
Commit
83833e8
·
verified ·
1 Parent(s): 944b5d8

Training in progress, step 450, checkpoint

Browse files
checkpoint-450/adapter_config.json CHANGED
@@ -24,13 +24,13 @@
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
27
- "o_proj",
28
- "k_proj",
29
  "gate_proj",
 
30
  "v_proj",
31
  "down_proj",
 
32
  "up_proj",
33
- "q_proj"
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
 
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
 
 
27
  "gate_proj",
28
+ "q_proj",
29
  "v_proj",
30
  "down_proj",
31
+ "o_proj",
32
  "up_proj",
33
+ "k_proj"
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
checkpoint-450/trainer_state.json CHANGED
@@ -362,9 +362,9 @@
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593257665634155,
365
- "eval_runtime": 18.8102,
366
- "eval_samples_per_second": 37.48,
367
- "eval_steps_per_second": 18.766,
368
  "step": 50
369
  },
370
  {
@@ -720,9 +720,9 @@
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821334719657898,
723
- "eval_runtime": 18.8896,
724
- "eval_samples_per_second": 37.322,
725
- "eval_steps_per_second": 18.688,
726
  "step": 100
727
  },
728
  {
@@ -1078,9 +1078,9 @@
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.8017936944961548,
1081
- "eval_runtime": 18.8835,
1082
- "eval_samples_per_second": 37.334,
1083
- "eval_steps_per_second": 18.694,
1084
  "step": 150
1085
  },
1086
  {
@@ -1436,9 +1436,9 @@
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7910906076431274,
1439
- "eval_runtime": 18.8348,
1440
- "eval_samples_per_second": 37.431,
1441
- "eval_steps_per_second": 18.742,
1442
  "step": 200
1443
  },
1444
  {
@@ -1794,9 +1794,9 @@
1794
  {
1795
  "epoch": 0.6305170239596469,
1796
  "eval_loss": 1.7830545902252197,
1797
- "eval_runtime": 18.8692,
1798
- "eval_samples_per_second": 37.362,
1799
- "eval_steps_per_second": 18.708,
1800
  "step": 250
1801
  },
1802
  {
@@ -2152,9 +2152,9 @@
2152
  {
2153
  "epoch": 0.7566204287515763,
2154
  "eval_loss": 1.7733962535858154,
2155
- "eval_runtime": 18.9029,
2156
- "eval_samples_per_second": 37.296,
2157
- "eval_steps_per_second": 18.674,
2158
  "step": 300
2159
  },
2160
  {
@@ -2510,9 +2510,9 @@
2510
  {
2511
  "epoch": 0.8827238335435057,
2512
  "eval_loss": 1.7664289474487305,
2513
- "eval_runtime": 19.1441,
2514
- "eval_samples_per_second": 36.826,
2515
- "eval_steps_per_second": 18.439,
2516
  "step": 350
2517
  },
2518
  {
@@ -2868,9 +2868,9 @@
2868
  {
2869
  "epoch": 1.0075662042875158,
2870
  "eval_loss": 1.7607698440551758,
2871
- "eval_runtime": 18.8004,
2872
- "eval_samples_per_second": 37.499,
2873
- "eval_steps_per_second": 18.776,
2874
  "step": 400
2875
  },
2876
  {
@@ -3226,9 +3226,9 @@
3226
  {
3227
  "epoch": 1.1336696090794451,
3228
  "eval_loss": 1.7592146396636963,
3229
- "eval_runtime": 18.8668,
3230
- "eval_samples_per_second": 37.367,
3231
- "eval_steps_per_second": 18.71,
3232
  "step": 450
3233
  }
3234
  ],
 
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593257665634155,
365
+ "eval_runtime": 19.3972,
366
+ "eval_samples_per_second": 36.345,
367
+ "eval_steps_per_second": 18.198,
368
  "step": 50
369
  },
370
  {
 
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821334719657898,
723
+ "eval_runtime": 19.3187,
724
+ "eval_samples_per_second": 36.493,
725
+ "eval_steps_per_second": 18.272,
726
  "step": 100
727
  },
728
  {
 
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.8017936944961548,
1081
+ "eval_runtime": 19.5165,
1082
+ "eval_samples_per_second": 36.123,
1083
+ "eval_steps_per_second": 18.087,
1084
  "step": 150
1085
  },
1086
  {
 
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7910906076431274,
1439
+ "eval_runtime": 19.0069,
1440
+ "eval_samples_per_second": 37.092,
1441
+ "eval_steps_per_second": 18.572,
1442
  "step": 200
1443
  },
1444
  {
 
1794
  {
1795
  "epoch": 0.6305170239596469,
1796
  "eval_loss": 1.7830545902252197,
1797
+ "eval_runtime": 19.0502,
1798
+ "eval_samples_per_second": 37.008,
1799
+ "eval_steps_per_second": 18.53,
1800
  "step": 250
1801
  },
1802
  {
 
2152
  {
2153
  "epoch": 0.7566204287515763,
2154
  "eval_loss": 1.7733962535858154,
2155
+ "eval_runtime": 19.1336,
2156
+ "eval_samples_per_second": 36.846,
2157
+ "eval_steps_per_second": 18.449,
2158
  "step": 300
2159
  },
2160
  {
 
2510
  {
2511
  "epoch": 0.8827238335435057,
2512
  "eval_loss": 1.7664289474487305,
2513
+ "eval_runtime": 19.2628,
2514
+ "eval_samples_per_second": 36.599,
2515
+ "eval_steps_per_second": 18.326,
2516
  "step": 350
2517
  },
2518
  {
 
2868
  {
2869
  "epoch": 1.0075662042875158,
2870
  "eval_loss": 1.7607698440551758,
2871
+ "eval_runtime": 19.095,
2872
+ "eval_samples_per_second": 36.921,
2873
+ "eval_steps_per_second": 18.487,
2874
  "step": 400
2875
  },
2876
  {
 
3226
  {
3227
  "epoch": 1.1336696090794451,
3228
  "eval_loss": 1.7592146396636963,
3229
+ "eval_runtime": 18.9658,
3230
+ "eval_samples_per_second": 37.172,
3231
+ "eval_steps_per_second": 18.612,
3232
  "step": 450
3233
  }
3234
  ],
checkpoint-450/training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:ec3d8df95ba642eec10e761db819efa4c74dbd8edeed27cfd2cb36ccafa00305
3
  size 6161
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:98acfaad9c3466225d741aedf6691d0b64ec22dd7a298e7a5cde0e7f6a0d3d55
3
  size 6161