AlessaC commited on
Commit
5b8cd9d
·
verified ·
1 Parent(s): 0221fdc

Training in progress, step 200, checkpoint

Browse files
checkpoint-200/adapter_config.json CHANGED
@@ -24,13 +24,13 @@
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
 
27
  "v_proj",
 
28
  "o_proj",
29
  "gate_proj",
30
  "q_proj",
31
- "up_proj",
32
- "k_proj",
33
- "down_proj"
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
 
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
27
+ "up_proj",
28
  "v_proj",
29
+ "down_proj",
30
  "o_proj",
31
  "gate_proj",
32
  "q_proj",
33
+ "k_proj"
 
 
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
checkpoint-200/trainer_state.json CHANGED
@@ -362,9 +362,9 @@
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593026399612427,
365
- "eval_runtime": 12.7701,
366
- "eval_samples_per_second": 55.207,
367
- "eval_steps_per_second": 27.643,
368
  "step": 50
369
  },
370
  {
@@ -720,9 +720,9 @@
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821302890777588,
723
- "eval_runtime": 12.5842,
724
- "eval_samples_per_second": 56.023,
725
- "eval_steps_per_second": 28.051,
726
  "step": 100
727
  },
728
  {
@@ -1078,9 +1078,9 @@
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.801971435546875,
1081
- "eval_runtime": 12.5815,
1082
- "eval_samples_per_second": 56.034,
1083
- "eval_steps_per_second": 28.057,
1084
  "step": 150
1085
  },
1086
  {
@@ -1436,9 +1436,9 @@
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7911782264709473,
1439
- "eval_runtime": 12.5902,
1440
- "eval_samples_per_second": 55.996,
1441
- "eval_steps_per_second": 28.038,
1442
  "step": 200
1443
  }
1444
  ],
 
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593026399612427,
365
+ "eval_runtime": 12.6295,
366
+ "eval_samples_per_second": 55.821,
367
+ "eval_steps_per_second": 27.95,
368
  "step": 50
369
  },
370
  {
 
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821302890777588,
723
+ "eval_runtime": 12.4961,
724
+ "eval_samples_per_second": 56.418,
725
+ "eval_steps_per_second": 28.249,
726
  "step": 100
727
  },
728
  {
 
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.801971435546875,
1081
+ "eval_runtime": 12.4907,
1082
+ "eval_samples_per_second": 56.442,
1083
+ "eval_steps_per_second": 28.261,
1084
  "step": 150
1085
  },
1086
  {
 
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7911782264709473,
1439
+ "eval_runtime": 12.5152,
1440
+ "eval_samples_per_second": 56.331,
1441
+ "eval_steps_per_second": 28.206,
1442
  "step": 200
1443
  }
1444
  ],
checkpoint-200/training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:2b1ffd81bd9eb8f9fcd12e57c71348874ac8f9b1dcc65caff2a96a459db3f9c3
3
  size 6033
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:dfbfb846f405283867b637d0827bc8356f1a5b3fef1503b84b2e2c783812e63d
3
  size 6033