AlessaC commited on
Commit
7f9180a
·
verified ·
1 Parent(s): 1a7a8ca

Training in progress, step 200, checkpoint

Browse files
checkpoint-200/adapter_config.json CHANGED
@@ -24,13 +24,13 @@
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
27
- "down_proj",
28
- "gate_proj",
29
- "k_proj",
30
- "q_proj",
31
  "v_proj",
 
 
32
  "o_proj",
33
- "up_proj"
 
 
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
 
24
  "rank_pattern": {},
25
  "revision": null,
26
  "target_modules": [
 
 
 
 
27
  "v_proj",
28
+ "k_proj",
29
+ "gate_proj",
30
  "o_proj",
31
+ "down_proj",
32
+ "up_proj",
33
+ "q_proj"
34
  ],
35
  "task_type": "CAUSAL_LM",
36
  "trainable_token_indices": null,
checkpoint-200/tokenizer.json CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:9c5ae00e602b8860cbd784ba82a8aa14e8feecec692e7076590d014d7b7fdafa
3
- size 11421896
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:913950e4971737031da511cdd1b410daae4566f62eb845b3975bca5a102323d8
3
+ size 11421995
checkpoint-200/trainer_state.json CHANGED
@@ -362,9 +362,9 @@
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593257665634155,
365
- "eval_runtime": 19.2003,
366
- "eval_samples_per_second": 36.718,
367
- "eval_steps_per_second": 18.385,
368
  "step": 50
369
  },
370
  {
@@ -720,9 +720,9 @@
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821334719657898,
723
- "eval_runtime": 19.6836,
724
- "eval_samples_per_second": 35.817,
725
- "eval_steps_per_second": 17.934,
726
  "step": 100
727
  },
728
  {
@@ -1078,9 +1078,9 @@
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.8017936944961548,
1081
- "eval_runtime": 19.647,
1082
- "eval_samples_per_second": 35.883,
1083
- "eval_steps_per_second": 17.967,
1084
  "step": 150
1085
  },
1086
  {
@@ -1436,9 +1436,9 @@
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7910906076431274,
1439
- "eval_runtime": 19.1164,
1440
- "eval_samples_per_second": 36.879,
1441
- "eval_steps_per_second": 18.466,
1442
  "step": 200
1443
  }
1444
  ],
@@ -1446,7 +1446,7 @@
1446
  "max_steps": 794,
1447
  "num_input_tokens_seen": 0,
1448
  "num_train_epochs": 2,
1449
- "save_steps": 200,
1450
  "stateful_callbacks": {
1451
  "TrainerControl": {
1452
  "args": {
 
362
  {
363
  "epoch": 0.12610340479192939,
364
  "eval_loss": 1.8593257665634155,
365
+ "eval_runtime": 18.9014,
366
+ "eval_samples_per_second": 37.299,
367
+ "eval_steps_per_second": 18.676,
368
  "step": 50
369
  },
370
  {
 
720
  {
721
  "epoch": 0.25220680958385877,
722
  "eval_loss": 1.821334719657898,
723
+ "eval_runtime": 19.2199,
724
+ "eval_samples_per_second": 36.681,
725
+ "eval_steps_per_second": 18.366,
726
  "step": 100
727
  },
728
  {
 
1078
  {
1079
  "epoch": 0.37831021437578816,
1080
  "eval_loss": 1.8017936944961548,
1081
+ "eval_runtime": 18.9235,
1082
+ "eval_samples_per_second": 37.255,
1083
+ "eval_steps_per_second": 18.654,
1084
  "step": 150
1085
  },
1086
  {
 
1436
  {
1437
  "epoch": 0.5044136191677175,
1438
  "eval_loss": 1.7910906076431274,
1439
+ "eval_runtime": 18.9166,
1440
+ "eval_samples_per_second": 37.269,
1441
+ "eval_steps_per_second": 18.661,
1442
  "step": 200
1443
  }
1444
  ],
 
1446
  "max_steps": 794,
1447
  "num_input_tokens_seen": 0,
1448
  "num_train_epochs": 2,
1449
+ "save_steps": 50,
1450
  "stateful_callbacks": {
1451
  "TrainerControl": {
1452
  "args": {
checkpoint-200/training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:908ac25afcecebd00cf3e224398e924723fc17436e832bf290d1f7c335a5a4b7
3
  size 6161
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c5837a9ab69dc67dc3394365dc023f22756863ff5c486b65993199054047c5ed
3
  size 6161