leminda-ai commited on
Commit
65056b7
·
verified ·
1 Parent(s): 62cf861

Training in progress, step 500

Browse files
Files changed (3) hide show
  1. config.json +53 -52
  2. model.safetensors +1 -1
  3. training_args.bin +2 -2
config.json CHANGED
@@ -1,5 +1,5 @@
1
  {
2
- "_name_or_path": "/content/alephbertgimmel/alephbertgimmel-base/ckpt_69200--Max128Seq",
3
  "architectures": [
4
  "BertForMultiLabelTokenClassification"
5
  ],
@@ -10,70 +10,71 @@
10
  "hidden_dropout_prob": 0.1,
11
  "hidden_size": 768,
12
  "id2label": {
13
- "0": "\"#",
14
- "1": "#\u05d4",
15
- "2": "#\u05d4\u05d5",
16
- "3": "#\u05d4\u05dd",
17
- "4": "#\u05d4\u05df",
18
- "5": "#\u05d5",
19
- "6": "#\u05d9",
20
- "7": "#\u05d9\u05d4",
21
- "8": "#\u05d9\u05d5",
22
- "9": "#\u05da",
23
- "10": "#\u05db\u05dd",
24
- "11": "#\u05dd",
25
- "12": "#\u05df",
26
- "13": "#\u05e0\u05d5",
27
- "14": "#\u05e0\u05d9",
28
- "15": "'#",
29
- "16": "\u05d1#",
30
- "17": "\u05d4#",
31
- "18": "\u05d5#",
32
- "19": "\u05db#",
33
- "20": "\u05db\u05e9#",
34
- "21": "\u05dc#",
35
- "22": "\u05de#",
36
- "23": "\u05de\u05e9#",
37
- "24": "\u05e9#"
38
  },
39
  "initializer_range": 0.02,
40
  "intermediate_size": 3072,
41
  "label2id": {
42
- "\"#": 0,
43
- "#\u05d4": 1,
44
- "#\u05d4\u05d5": 2,
45
- "#\u05d4\u05dd": 3,
46
- "#\u05d4\u05df": 4,
47
- "#\u05d5": 5,
48
- "#\u05d9": 6,
49
- "#\u05d9\u05d4": 7,
50
- "#\u05d9\u05d5": 8,
51
- "#\u05da": 9,
52
- "#\u05db\u05dd": 10,
53
- "#\u05dd": 11,
54
- "#\u05df": 12,
55
- "#\u05e0\u05d5": 13,
56
- "#\u05e0\u05d9": 14,
57
- "'#": 15,
58
- "\u05d1#": 16,
59
- "\u05d4#": 17,
60
- "\u05d5#": 18,
61
- "\u05db#": 19,
62
- "\u05db\u05e9#": 20,
63
- "\u05dc#": 21,
64
- "\u05de#": 22,
65
- "\u05de\u05e9#": 23,
66
- "\u05e9#": 24
67
  },
68
  "layer_norm_eps": 1e-12,
69
  "max_position_embeddings": 512,
70
  "model_type": "bert",
 
71
  "num_attention_heads": 12,
72
  "num_hidden_layers": 12,
73
  "pad_token_id": 3,
74
  "position_embedding_type": "absolute",
75
  "torch_dtype": "float32",
76
- "transformers_version": "4.42.4",
77
  "type_vocab_size": 2,
78
  "use_cache": true,
79
  "vocab_size": 128000
 
1
  {
2
+ "_name_or_path": "dicta-il/dictabert",
3
  "architectures": [
4
  "BertForMultiLabelTokenClassification"
5
  ],
 
10
  "hidden_dropout_prob": 0.1,
11
  "hidden_size": 768,
12
  "id2label": {
13
+ "0": "\"_",
14
+ "1": "_\u05d4",
15
+ "2": "_\u05d4\u05d5",
16
+ "3": "_\u05d4\u05dd",
17
+ "4": "_\u05d4\u05df",
18
+ "5": "_\u05d5",
19
+ "6": "_\u05d9",
20
+ "7": "_\u05d9\u05d4",
21
+ "8": "_\u05d9\u05d5",
22
+ "9": "_\u05da",
23
+ "10": "_\u05db\u05dd",
24
+ "11": "_\u05dd",
25
+ "12": "_\u05df",
26
+ "13": "_\u05e0\u05d5",
27
+ "14": "_\u05e0\u05d9",
28
+ "15": "'_",
29
+ "16": "\u05d1_",
30
+ "17": "\u05d4_",
31
+ "18": "\u05d5_",
32
+ "19": "\u05db_",
33
+ "20": "\u05db\u05e9_",
34
+ "21": "\u05dc_",
35
+ "22": "\u05de_",
36
+ "23": "\u05de\u05e9_",
37
+ "24": "\u05e9_"
38
  },
39
  "initializer_range": 0.02,
40
  "intermediate_size": 3072,
41
  "label2id": {
42
+ "\"_": 0,
43
+ "'_": 15,
44
+ "_\u05d4": 1,
45
+ "_\u05d4\u05d5": 2,
46
+ "_\u05d4\u05dd": 3,
47
+ "_\u05d4\u05df": 4,
48
+ "_\u05d5": 5,
49
+ "_\u05d9": 6,
50
+ "_\u05d9\u05d4": 7,
51
+ "_\u05d9\u05d5": 8,
52
+ "_\u05da": 9,
53
+ "_\u05db\u05dd": 10,
54
+ "_\u05dd": 11,
55
+ "_\u05df": 12,
56
+ "_\u05e0\u05d5": 13,
57
+ "_\u05e0\u05d9": 14,
58
+ "\u05d1_": 16,
59
+ "\u05d4_": 17,
60
+ "\u05d5_": 18,
61
+ "\u05db_": 19,
62
+ "\u05db\u05e9_": 20,
63
+ "\u05dc_": 21,
64
+ "\u05de_": 22,
65
+ "\u05de\u05e9_": 23,
66
+ "\u05e9_": 24
67
  },
68
  "layer_norm_eps": 1e-12,
69
  "max_position_embeddings": 512,
70
  "model_type": "bert",
71
+ "newmodern": true,
72
  "num_attention_heads": 12,
73
  "num_hidden_layers": 12,
74
  "pad_token_id": 3,
75
  "position_embedding_type": "absolute",
76
  "torch_dtype": "float32",
77
+ "transformers_version": "4.44.2",
78
  "type_vocab_size": 2,
79
  "use_cache": true,
80
  "vocab_size": 128000
model.safetensors CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:59632fc76e123148e48acf19385974914a620dd494006fcafccd92d766f034c2
3
  size 737481828
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4ba6f823fcf23e199bef2bd088934755bbf15e68ac038e47124cd2b1662c64e8
3
  size 737481828
training_args.bin CHANGED
@@ -1,3 +1,3 @@
1
  version https://git-lfs.github.com/spec/v1
2
- oid sha256:97c5bc0b21e3a45847eb7b2dff5d71bbfd6dcb14d93d3fefd1d06b922e1ab80e
3
- size 5112
 
1
  version https://git-lfs.github.com/spec/v1
2
+ oid sha256:4b633f8af621f04c3059319313f56173bfef1681bc39f00ff7478e47c7caf7b2
3
+ size 5176