AlessaC commited on
Commit
261e550
·
verified ·
1 Parent(s): bbd6f01

Training in progress, step 200, checkpoint

Browse files
checkpoint-200/adapter_config.json CHANGED
@@ -24,13 +24,13 @@
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
27
- "o_proj",
28
- "k_proj",
29
  "gate_proj",
 
30
  "v_proj",
31
  "down_proj",
 
32
  "up_proj",
33
- "q_proj"
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
 
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
 
 
27
  "gate_proj",
28
+ "q_proj",
29
  "v_proj",
30
  "down_proj",
31
+ "o_proj",
32
  "up_proj",
33
+ "k_proj"
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
checkpoint-200/trainer_state.json CHANGED
@@ -362,9 +362,9 @@
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593257665634155,
365
- "eval_runtime": 18.8102,
366
- "eval_samples_per_second": 37.48,
367
- "eval_steps_per_second": 18.766,
368
  "step": 50
369
  },
370
  {
@@ -720,9 +720,9 @@
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821334719657898,
723
- "eval_runtime": 18.8896,
724
- "eval_samples_per_second": 37.322,
725
- "eval_steps_per_second": 18.688,
726
  "step": 100
727
  },
728
  {
@@ -1078,9 +1078,9 @@
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.8017936944961548,
1081
- "eval_runtime": 18.8835,
1082
- "eval_samples_per_second": 37.334,
1083
- "eval_steps_per_second": 18.694,
1084
  "step": 150
1085
  },
1086
  {
@@ -1436,9 +1436,9 @@
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7910906076431274,
1439
- "eval_runtime": 18.8348,
1440
- "eval_samples_per_second": 37.431,
1441
- "eval_steps_per_second": 18.742,
1442
  "step": 200
1443
  }
1444
  ],
 
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593257665634155,
365
+ "eval_runtime": 19.3972,
366
+ "eval_samples_per_second": 36.345,
367
+ "eval_steps_per_second": 18.198,
368
  "step": 50
369
  },
370
  {
 
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821334719657898,
723
+ "eval_runtime": 19.3187,
724
+ "eval_samples_per_second": 36.493,
725
+ "eval_steps_per_second": 18.272,
726
  "step": 100
727
  },
728
  {
 
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.8017936944961548,
1081
+ "eval_runtime": 19.5165,
1082
+ "eval_samples_per_second": 36.123,
1083
+ "eval_steps_per_second": 18.087,
1084
  "step": 150
1085
  },
1086
  {
 
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7910906076431274,
1439
+ "eval_runtime": 19.0069,
1440
+ "eval_samples_per_second": 37.092,
1441
+ "eval_steps_per_second": 18.572,
1442
  "step": 200
1443
  }
1444
  ],
checkpoint-200/training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:ec3d8df95ba642eec10e761db819efa4c74dbd8edeed27cfd2cb36ccafa00305
3
  size 6161
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:98acfaad9c3466225d741aedf6691d0b64ec22dd7a298e7a5cde0e7f6a0d3d55
3
  size 6161