sanmonga22 commited on
Commit
85fbc5b
·
verified ·
1 Parent(s): 38c1dcc

Add lut8_g32_c6: phone-safe 6-chunk 8-bit bundle (every graph under the iOS 500 MB tier)

Browse files
Files changed (33) hide show
  1. lut8_g32_c6/GATE_P.json +42 -0
  2. lut8_g32_c6/PRECISION.json +18 -0
  3. lut8_g32_c6/lfm2-5-2-6b.json +151 -0
  4. lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.iodesc.json +60 -0
  5. lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.mlpackage/Data/com.apple.CoreML/model.mlmodel +3 -0
  6. lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.mlpackage/Data/com.apple.CoreML/weights/weight.bin +3 -0
  7. lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.mlpackage/Manifest.json +18 -0
  8. lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.iodesc.json +66 -0
  9. lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.mlpackage/Data/com.apple.CoreML/model.mlmodel +3 -0
  10. lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.mlpackage/Data/com.apple.CoreML/weights/weight.bin +3 -0
  11. lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.mlpackage/Manifest.json +18 -0
  12. lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.iodesc.json +60 -0
  13. lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.mlpackage/Data/com.apple.CoreML/model.mlmodel +3 -0
  14. lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.mlpackage/Data/com.apple.CoreML/weights/weight.bin +3 -0
  15. lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.mlpackage/Manifest.json +18 -0
  16. lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.iodesc.json +60 -0
  17. lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.mlpackage/Data/com.apple.CoreML/model.mlmodel +3 -0
  18. lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.mlpackage/Data/com.apple.CoreML/weights/weight.bin +3 -0
  19. lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.mlpackage/Manifest.json +18 -0
  20. lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.iodesc.json +66 -0
  21. lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.mlpackage/Data/com.apple.CoreML/model.mlmodel +3 -0
  22. lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.mlpackage/Data/com.apple.CoreML/weights/weight.bin +3 -0
  23. lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.mlpackage/Manifest.json +18 -0
  24. lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.iodesc.json +60 -0
  25. lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.mlpackage/Data/com.apple.CoreML/model.mlmodel +3 -0
  26. lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.mlpackage/Data/com.apple.CoreML/weights/weight.bin +3 -0
  27. lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.mlpackage/Manifest.json +18 -0
  28. lut8_g32_c6/lfm2_5_2_6b_embed_f16.bin +3 -0
  29. lut8_g32_c6/lfm2_5_2_6b_lmhead.iodesc.json +33 -0
  30. lut8_g32_c6/lfm2_5_2_6b_lmhead.mlpackage/Data/com.apple.CoreML/model.mlmodel +3 -0
  31. lut8_g32_c6/lfm2_5_2_6b_lmhead.mlpackage/Data/com.apple.CoreML/weights/weight.bin +3 -0
  32. lut8_g32_c6/lfm2_5_2_6b_lmhead.mlpackage/Manifest.json +18 -0
  33. lut8_g32_c6/tokenizer.json +3 -0
lut8_g32_c6/GATE_P.json ADDED
@@ -0,0 +1,42 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "bundle": "_work/bundle_w8_6ch",
3
+ "graphs": [
4
+ {
5
+ "name": "lfm2_5_2_6b_decode_chunk0.mlpackage",
6
+ "size_mb": 410.671028,
7
+ "bucket": "safe"
8
+ },
9
+ {
10
+ "name": "lfm2_5_2_6b_decode_chunk1.mlpackage",
11
+ "size_mb": 404.302451,
12
+ "bucket": "safe"
13
+ },
14
+ {
15
+ "name": "lfm2_5_2_6b_decode_chunk2.mlpackage",
16
+ "size_mb": 410.671031,
17
+ "bucket": "safe"
18
+ },
19
+ {
20
+ "name": "lfm2_5_2_6b_decode_chunk3.mlpackage",
21
+ "size_mb": 410.671046,
22
+ "bucket": "safe"
23
+ },
24
+ {
25
+ "name": "lfm2_5_2_6b_decode_chunk4.mlpackage",
26
+ "size_mb": 404.302533,
27
+ "bucket": "safe"
28
+ },
29
+ {
30
+ "name": "lfm2_5_2_6b_decode_chunk5.mlpackage",
31
+ "size_mb": 410.676897,
32
+ "bucket": "safe"
33
+ },
34
+ {
35
+ "name": "lfm2_5_2_6b_lmhead.mlpackage",
36
+ "size_mb": 264.204321,
37
+ "bucket": "safe"
38
+ }
39
+ ],
40
+ "device_tested": false,
41
+ "device_trials": []
42
+ }
lut8_g32_c6/PRECISION.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "level": "lut8_g32_c6",
3
+ "role": "exact",
4
+ "nbits": 8,
5
+ "mode": "kmeans",
6
+ "granularity": "per_grouped_channel",
7
+ "group_size": 32,
8
+ "compute_precision": "fp16",
9
+ "chunks": 6,
10
+ "bundle_mb": 3106.8,
11
+ "largest_graph_mb": 410.7,
12
+ "ios_gate_p": "PASS",
13
+ "ios_note": "Every graph is under the ~500 MB per-graph size measured 100% reliable on iPhone. The sibling lut8_g32 is the same precision in 4 chunks and peaks at 654 MB, which lands in the 500 MB-1 GB band measured NON-DETERMINISTIC on device.",
14
+ "quality_frac_vs_fp16": 1.0,
15
+ "suite_correct": "21/23",
16
+ "fp16_suite_correct": "21/23",
17
+ "notes": "Weight-only 8-bit LUT palettization; compute stays fp16. RMSNorm scale vectors are deliberately left in fp16 (they sit exactly at the 2048-element weight_threshold, 0.1 MiB total). Re-chunking 4->6 cost no throughput."
18
+ }
lut8_g32_c6/lfm2-5-2-6b.json ADDED
@@ -0,0 +1,151 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "schema": 1,
3
+ "name": "lfm2-5-2-6b",
4
+ "family": "llm",
5
+ "source": "LiquidAI/LFM2.5-2.6B",
6
+ "target": {
7
+ "backend": "coreml",
8
+ "min_os": "macOS15"
9
+ },
10
+ "arch": {
11
+ "hidden": 2048,
12
+ "q_heads": 32,
13
+ "kv_heads": 8,
14
+ "head_dim": 64,
15
+ "layers": 30,
16
+ "vocab": 128000,
17
+ "eps": 1e-05
18
+ },
19
+ "rope": {
20
+ "strategy": "standard_1d",
21
+ "theta": 10000000.0
22
+ },
23
+ "layers_schedule": {
24
+ "schedule": "hybrid",
25
+ "attn_idx": [
26
+ 2,
27
+ 5,
28
+ 9,
29
+ 13,
30
+ 17,
31
+ 21,
32
+ 24,
33
+ 27
34
+ ],
35
+ "conv_idx": [
36
+ 0,
37
+ 1,
38
+ 3,
39
+ 4,
40
+ 6,
41
+ 7,
42
+ 8,
43
+ 10,
44
+ 11,
45
+ 12,
46
+ 14,
47
+ 15,
48
+ 16,
49
+ 18,
50
+ 19,
51
+ 20,
52
+ 22,
53
+ 23,
54
+ 25,
55
+ 26,
56
+ 28,
57
+ 29
58
+ ],
59
+ "conv_kernel": 3
60
+ },
61
+ "artifacts": {
62
+ "graphs": {
63
+ "chunk0": {
64
+ "package": "lfm2_5_2_6b_decode_chunk0.mlpackage",
65
+ "compiled": "lfm2_5_2_6b_decode_chunk0.mlmodelc",
66
+ "seq": 1,
67
+ "ctx": 512,
68
+ "precision": "fp16",
69
+ "compute_units": "cpuAndNeuralEngine",
70
+ "stateful": false
71
+ },
72
+ "chunk1": {
73
+ "package": "lfm2_5_2_6b_decode_chunk1.mlpackage",
74
+ "compiled": "lfm2_5_2_6b_decode_chunk1.mlmodelc",
75
+ "seq": 1,
76
+ "ctx": 512,
77
+ "precision": "fp16",
78
+ "compute_units": "cpuAndNeuralEngine",
79
+ "stateful": false
80
+ },
81
+ "chunk2": {
82
+ "package": "lfm2_5_2_6b_decode_chunk2.mlpackage",
83
+ "compiled": "lfm2_5_2_6b_decode_chunk2.mlmodelc",
84
+ "seq": 1,
85
+ "ctx": 512,
86
+ "precision": "fp16",
87
+ "compute_units": "cpuAndNeuralEngine",
88
+ "stateful": false
89
+ },
90
+ "chunk3": {
91
+ "package": "lfm2_5_2_6b_decode_chunk3.mlpackage",
92
+ "compiled": "lfm2_5_2_6b_decode_chunk3.mlmodelc",
93
+ "seq": 1,
94
+ "ctx": 512,
95
+ "precision": "fp16",
96
+ "compute_units": "cpuAndNeuralEngine",
97
+ "stateful": false
98
+ },
99
+ "chunk4": {
100
+ "package": "lfm2_5_2_6b_decode_chunk4.mlpackage",
101
+ "compiled": "lfm2_5_2_6b_decode_chunk4.mlmodelc",
102
+ "seq": 1,
103
+ "ctx": 512,
104
+ "precision": "fp16",
105
+ "compute_units": "cpuAndNeuralEngine",
106
+ "stateful": false
107
+ },
108
+ "chunk5": {
109
+ "package": "lfm2_5_2_6b_decode_chunk5.mlpackage",
110
+ "compiled": "lfm2_5_2_6b_decode_chunk5.mlmodelc",
111
+ "seq": 1,
112
+ "ctx": 512,
113
+ "precision": "fp16",
114
+ "compute_units": "cpuAndNeuralEngine",
115
+ "stateful": false
116
+ },
117
+ "lmhead": {
118
+ "package": "lfm2_5_2_6b_lmhead.mlpackage",
119
+ "compiled": "lfm2_5_2_6b_lmhead.mlmodelc",
120
+ "seq": 1,
121
+ "ctx": 512,
122
+ "precision": "fp16",
123
+ "compute_units": "cpuAndNeuralEngine",
124
+ "stateful": false
125
+ }
126
+ },
127
+ "host_weights": {
128
+ "embed": "lfm2_5_2_6b_embed_f16.bin"
129
+ },
130
+ "tokenizer": "tokenizer.json"
131
+ },
132
+ "lmhead": {
133
+ "slices": 8,
134
+ "slice_width": 16000,
135
+ "vocab": 128000,
136
+ "argmax_in_graph": false
137
+ },
138
+ "host_params": {
139
+ "max_new": 64,
140
+ "mask_neg": -40000.0
141
+ },
142
+ "success": {
143
+ "parity": "greedy_exact",
144
+ "cosine_min": 0.999,
145
+ "min_tok_per_s": 4.0
146
+ },
147
+ "chat": {
148
+ "prefix": "<|startoftext|><|im_start|>user\n",
149
+ "suffix": "<|im_end|>\n<|im_start|>assistant\n<think>"
150
+ }
151
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.iodesc.json ADDED
@@ -0,0 +1,60 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "input": [
3
+ {
4
+ "name": "x"
5
+ },
6
+ {
7
+ "name": "cos"
8
+ },
9
+ {
10
+ "name": "sin"
11
+ },
12
+ {
13
+ "name": "mask"
14
+ },
15
+ {
16
+ "name": "wmask"
17
+ },
18
+ {
19
+ "name": "past_k_2"
20
+ },
21
+ {
22
+ "name": "past_v_2"
23
+ },
24
+ {
25
+ "name": "past_conv_0"
26
+ },
27
+ {
28
+ "name": "past_conv_1"
29
+ },
30
+ {
31
+ "name": "past_conv_3"
32
+ },
33
+ {
34
+ "name": "past_conv_4"
35
+ }
36
+ ],
37
+ "output": [
38
+ {
39
+ "name": "var_681"
40
+ },
41
+ {
42
+ "name": "k_cache"
43
+ },
44
+ {
45
+ "name": "v_cache"
46
+ },
47
+ {
48
+ "name": "var_79"
49
+ },
50
+ {
51
+ "name": "var_189"
52
+ },
53
+ {
54
+ "name": "var_522"
55
+ },
56
+ {
57
+ "name": "var_632"
58
+ }
59
+ ]
60
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.mlpackage/Data/com.apple.CoreML/model.mlmodel ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:7e7521042e8eff13302286ee44b17af65e513ad2e2e5c15e716f51faf2fc29f1
3
+ size 82315
lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.mlpackage/Data/com.apple.CoreML/weights/weight.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c7d1d53144ead5a8262d820a2d98f0df117fc997388fd86c961d48d21fc84859
3
+ size 410588096
lut8_g32_c6/lfm2_5_2_6b_decode_chunk0.mlpackage/Manifest.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "fileFormatVersion": "1.0.0",
3
+ "itemInfoEntries": {
4
+ "46A50CB4-C6BB-4332-98AC-54DF6D7B602C": {
5
+ "author": "com.apple.CoreML",
6
+ "description": "CoreML Model Specification",
7
+ "name": "model.mlmodel",
8
+ "path": "com.apple.CoreML/model.mlmodel"
9
+ },
10
+ "7ED2BBAB-1F76-4FFB-80D0-9B2590A59473": {
11
+ "author": "com.apple.CoreML",
12
+ "description": "CoreML Model Weights",
13
+ "name": "weights",
14
+ "path": "com.apple.CoreML/weights"
15
+ }
16
+ },
17
+ "rootModelIdentifier": "46A50CB4-C6BB-4332-98AC-54DF6D7B602C"
18
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.iodesc.json ADDED
@@ -0,0 +1,66 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "input": [
3
+ {
4
+ "name": "x"
5
+ },
6
+ {
7
+ "name": "cos"
8
+ },
9
+ {
10
+ "name": "sin"
11
+ },
12
+ {
13
+ "name": "mask"
14
+ },
15
+ {
16
+ "name": "wmask"
17
+ },
18
+ {
19
+ "name": "past_k_5"
20
+ },
21
+ {
22
+ "name": "past_k_9"
23
+ },
24
+ {
25
+ "name": "past_v_5"
26
+ },
27
+ {
28
+ "name": "past_v_9"
29
+ },
30
+ {
31
+ "name": "past_conv_6"
32
+ },
33
+ {
34
+ "name": "past_conv_7"
35
+ },
36
+ {
37
+ "name": "past_conv_8"
38
+ }
39
+ ],
40
+ "output": [
41
+ {
42
+ "name": "var_794"
43
+ },
44
+ {
45
+ "name": "k_cache_3"
46
+ },
47
+ {
48
+ "name": "k_cache"
49
+ },
50
+ {
51
+ "name": "v_cache_3"
52
+ },
53
+ {
54
+ "name": "v_cache"
55
+ },
56
+ {
57
+ "name": "var_303"
58
+ },
59
+ {
60
+ "name": "var_413"
61
+ },
62
+ {
63
+ "name": "var_523"
64
+ }
65
+ ]
66
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.mlpackage/Data/com.apple.CoreML/model.mlmodel ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3311f1ac9d7402feb26cc25e0d37c567424738ffeb923ac4551dc6c04e4beb6c
3
+ size 92746
lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.mlpackage/Data/com.apple.CoreML/weights/weight.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a7909b6a2f1a5e26f8deb118ca3b7823fec50142350392e26b956940c497f787
3
+ size 404209088
lut8_g32_c6/lfm2_5_2_6b_decode_chunk1.mlpackage/Manifest.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "fileFormatVersion": "1.0.0",
3
+ "itemInfoEntries": {
4
+ "09533B0D-8D25-4889-8625-6EC6C25EA5A9": {
5
+ "author": "com.apple.CoreML",
6
+ "description": "CoreML Model Specification",
7
+ "name": "model.mlmodel",
8
+ "path": "com.apple.CoreML/model.mlmodel"
9
+ },
10
+ "AACDF466-F84D-41BA-9FBD-37C508991CF5": {
11
+ "author": "com.apple.CoreML",
12
+ "description": "CoreML Model Weights",
13
+ "name": "weights",
14
+ "path": "com.apple.CoreML/weights"
15
+ }
16
+ },
17
+ "rootModelIdentifier": "09533B0D-8D25-4889-8625-6EC6C25EA5A9"
18
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.iodesc.json ADDED
@@ -0,0 +1,60 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "input": [
3
+ {
4
+ "name": "x"
5
+ },
6
+ {
7
+ "name": "cos"
8
+ },
9
+ {
10
+ "name": "sin"
11
+ },
12
+ {
13
+ "name": "mask"
14
+ },
15
+ {
16
+ "name": "wmask"
17
+ },
18
+ {
19
+ "name": "past_k_13"
20
+ },
21
+ {
22
+ "name": "past_v_13"
23
+ },
24
+ {
25
+ "name": "past_conv_10"
26
+ },
27
+ {
28
+ "name": "past_conv_11"
29
+ },
30
+ {
31
+ "name": "past_conv_12"
32
+ },
33
+ {
34
+ "name": "past_conv_14"
35
+ }
36
+ ],
37
+ "output": [
38
+ {
39
+ "name": "var_681"
40
+ },
41
+ {
42
+ "name": "k_cache"
43
+ },
44
+ {
45
+ "name": "v_cache"
46
+ },
47
+ {
48
+ "name": "var_79"
49
+ },
50
+ {
51
+ "name": "var_189"
52
+ },
53
+ {
54
+ "name": "var_299"
55
+ },
56
+ {
57
+ "name": "var_632"
58
+ }
59
+ ]
60
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.mlpackage/Data/com.apple.CoreML/model.mlmodel ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:fd1d126980b526113a5b8ccc2ec10dc689c0c8c6a7eacc86e957bf36b389a53d
3
+ size 82318
lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.mlpackage/Data/com.apple.CoreML/weights/weight.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:6018f40740cbf9c7876eec389c3111ecbd31f16b109f262a9d6ca50ace525287
3
+ size 410588096
lut8_g32_c6/lfm2_5_2_6b_decode_chunk2.mlpackage/Manifest.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "fileFormatVersion": "1.0.0",
3
+ "itemInfoEntries": {
4
+ "BCC39DC4-5FD5-4618-9AD2-CF1A49D5A1C0": {
5
+ "author": "com.apple.CoreML",
6
+ "description": "CoreML Model Weights",
7
+ "name": "weights",
8
+ "path": "com.apple.CoreML/weights"
9
+ },
10
+ "DAA1BF7F-4442-47E6-9113-CE378FF4DEC0": {
11
+ "author": "com.apple.CoreML",
12
+ "description": "CoreML Model Specification",
13
+ "name": "model.mlmodel",
14
+ "path": "com.apple.CoreML/model.mlmodel"
15
+ }
16
+ },
17
+ "rootModelIdentifier": "DAA1BF7F-4442-47E6-9113-CE378FF4DEC0"
18
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.iodesc.json ADDED
@@ -0,0 +1,60 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "input": [
3
+ {
4
+ "name": "x"
5
+ },
6
+ {
7
+ "name": "cos"
8
+ },
9
+ {
10
+ "name": "sin"
11
+ },
12
+ {
13
+ "name": "mask"
14
+ },
15
+ {
16
+ "name": "wmask"
17
+ },
18
+ {
19
+ "name": "past_k_17"
20
+ },
21
+ {
22
+ "name": "past_v_17"
23
+ },
24
+ {
25
+ "name": "past_conv_15"
26
+ },
27
+ {
28
+ "name": "past_conv_16"
29
+ },
30
+ {
31
+ "name": "past_conv_18"
32
+ },
33
+ {
34
+ "name": "past_conv_19"
35
+ }
36
+ ],
37
+ "output": [
38
+ {
39
+ "name": "var_681"
40
+ },
41
+ {
42
+ "name": "k_cache"
43
+ },
44
+ {
45
+ "name": "v_cache"
46
+ },
47
+ {
48
+ "name": "var_79"
49
+ },
50
+ {
51
+ "name": "var_189"
52
+ },
53
+ {
54
+ "name": "var_522"
55
+ },
56
+ {
57
+ "name": "var_632"
58
+ }
59
+ ]
60
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.mlpackage/Data/com.apple.CoreML/model.mlmodel ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:a48ef1b597ebf13dd2e5a3982e2117ecc61734364e798f60cf170eb64e0d7835
3
+ size 82333
lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.mlpackage/Data/com.apple.CoreML/weights/weight.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:9cc9018e3479d3e75df9a03e1ba4ee26c62de36e58b61176e88749a125ac2245
3
+ size 410588096
lut8_g32_c6/lfm2_5_2_6b_decode_chunk3.mlpackage/Manifest.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "fileFormatVersion": "1.0.0",
3
+ "itemInfoEntries": {
4
+ "0CA7B126-5BBF-4F32-8DA3-40741AEED3F7": {
5
+ "author": "com.apple.CoreML",
6
+ "description": "CoreML Model Specification",
7
+ "name": "model.mlmodel",
8
+ "path": "com.apple.CoreML/model.mlmodel"
9
+ },
10
+ "E3B52AA2-D202-448B-AF59-55D1FCD76F76": {
11
+ "author": "com.apple.CoreML",
12
+ "description": "CoreML Model Weights",
13
+ "name": "weights",
14
+ "path": "com.apple.CoreML/weights"
15
+ }
16
+ },
17
+ "rootModelIdentifier": "0CA7B126-5BBF-4F32-8DA3-40741AEED3F7"
18
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.iodesc.json ADDED
@@ -0,0 +1,66 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "input": [
3
+ {
4
+ "name": "x"
5
+ },
6
+ {
7
+ "name": "cos"
8
+ },
9
+ {
10
+ "name": "sin"
11
+ },
12
+ {
13
+ "name": "mask"
14
+ },
15
+ {
16
+ "name": "wmask"
17
+ },
18
+ {
19
+ "name": "past_k_21"
20
+ },
21
+ {
22
+ "name": "past_k_24"
23
+ },
24
+ {
25
+ "name": "past_v_21"
26
+ },
27
+ {
28
+ "name": "past_v_24"
29
+ },
30
+ {
31
+ "name": "past_conv_20"
32
+ },
33
+ {
34
+ "name": "past_conv_22"
35
+ },
36
+ {
37
+ "name": "past_conv_23"
38
+ }
39
+ ],
40
+ "output": [
41
+ {
42
+ "name": "var_794"
43
+ },
44
+ {
45
+ "name": "k_cache_3"
46
+ },
47
+ {
48
+ "name": "k_cache"
49
+ },
50
+ {
51
+ "name": "v_cache_3"
52
+ },
53
+ {
54
+ "name": "v_cache"
55
+ },
56
+ {
57
+ "name": "var_80"
58
+ },
59
+ {
60
+ "name": "var_413"
61
+ },
62
+ {
63
+ "name": "var_523"
64
+ }
65
+ ]
66
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.mlpackage/Data/com.apple.CoreML/model.mlmodel ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:c20a723924e315b085e1470957f9a58b753a7d1c8d0a55f1db1ed06440bdf460
3
+ size 92828
lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.mlpackage/Data/com.apple.CoreML/weights/weight.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:77c4e9a7c0a4b7c241f5f128ce86792111914abebf3bbdcc7c52fb22eec2cb03
3
+ size 404209088
lut8_g32_c6/lfm2_5_2_6b_decode_chunk4.mlpackage/Manifest.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "fileFormatVersion": "1.0.0",
3
+ "itemInfoEntries": {
4
+ "010F47CA-B583-4B5A-8766-7140274E15AD": {
5
+ "author": "com.apple.CoreML",
6
+ "description": "CoreML Model Weights",
7
+ "name": "weights",
8
+ "path": "com.apple.CoreML/weights"
9
+ },
10
+ "5CC037E8-8E3B-449C-B313-DAB7BFE88C22": {
11
+ "author": "com.apple.CoreML",
12
+ "description": "CoreML Model Specification",
13
+ "name": "model.mlmodel",
14
+ "path": "com.apple.CoreML/model.mlmodel"
15
+ }
16
+ },
17
+ "rootModelIdentifier": "5CC037E8-8E3B-449C-B313-DAB7BFE88C22"
18
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.iodesc.json ADDED
@@ -0,0 +1,60 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "input": [
3
+ {
4
+ "name": "x"
5
+ },
6
+ {
7
+ "name": "cos"
8
+ },
9
+ {
10
+ "name": "sin"
11
+ },
12
+ {
13
+ "name": "mask"
14
+ },
15
+ {
16
+ "name": "wmask"
17
+ },
18
+ {
19
+ "name": "past_k_27"
20
+ },
21
+ {
22
+ "name": "past_v_27"
23
+ },
24
+ {
25
+ "name": "past_conv_25"
26
+ },
27
+ {
28
+ "name": "past_conv_26"
29
+ },
30
+ {
31
+ "name": "past_conv_28"
32
+ },
33
+ {
34
+ "name": "past_conv_29"
35
+ }
36
+ ],
37
+ "output": [
38
+ {
39
+ "name": "var_707"
40
+ },
41
+ {
42
+ "name": "k_cache"
43
+ },
44
+ {
45
+ "name": "v_cache"
46
+ },
47
+ {
48
+ "name": "var_80"
49
+ },
50
+ {
51
+ "name": "var_190"
52
+ },
53
+ {
54
+ "name": "var_523"
55
+ },
56
+ {
57
+ "name": "var_633"
58
+ }
59
+ ]
60
+ }
lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.mlpackage/Data/com.apple.CoreML/model.mlmodel ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:3f7834e862e4f8235fe8cd42ba55b552125646f174d33bccd67a95b990f26a2f
3
+ size 84024
lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.mlpackage/Data/com.apple.CoreML/weights/weight.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:69b3d4fa947c15dcc4537c7743da17a80bfa2290d008d54be18a1c9fcd96636a
3
+ size 410592256
lut8_g32_c6/lfm2_5_2_6b_decode_chunk5.mlpackage/Manifest.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "fileFormatVersion": "1.0.0",
3
+ "itemInfoEntries": {
4
+ "0E4CB246-3795-4326-9A4C-2E3542AA1E9C": {
5
+ "author": "com.apple.CoreML",
6
+ "description": "CoreML Model Weights",
7
+ "name": "weights",
8
+ "path": "com.apple.CoreML/weights"
9
+ },
10
+ "7F4FA55F-43C6-4C67-95FB-81019471A10D": {
11
+ "author": "com.apple.CoreML",
12
+ "description": "CoreML Model Specification",
13
+ "name": "model.mlmodel",
14
+ "path": "com.apple.CoreML/model.mlmodel"
15
+ }
16
+ },
17
+ "rootModelIdentifier": "7F4FA55F-43C6-4C67-95FB-81019471A10D"
18
+ }
lut8_g32_c6/lfm2_5_2_6b_embed_f16.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:eb46a8d8858bccfc2b1766f8a48980507f55f4439a147b45d11d1997beee1a9a
3
+ size 524288000
lut8_g32_c6/lfm2_5_2_6b_lmhead.iodesc.json ADDED
@@ -0,0 +1,33 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "input": [
3
+ {
4
+ "name": "h"
5
+ }
6
+ ],
7
+ "output": [
8
+ {
9
+ "name": "var_29"
10
+ },
11
+ {
12
+ "name": "var_35"
13
+ },
14
+ {
15
+ "name": "var_41"
16
+ },
17
+ {
18
+ "name": "var_47"
19
+ },
20
+ {
21
+ "name": "var_53"
22
+ },
23
+ {
24
+ "name": "var_59"
25
+ },
26
+ {
27
+ "name": "var_65"
28
+ },
29
+ {
30
+ "name": "var_71"
31
+ }
32
+ ]
33
+ }
lut8_g32_c6/lfm2_5_2_6b_lmhead.mlpackage/Data/com.apple.CoreML/model.mlmodel ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:15fcf47333cfe1badc018d9939976e47a1bb0d25c2811231d60df0e78a7ba42c
3
+ size 10616
lut8_g32_c6/lfm2_5_2_6b_lmhead.mlpackage/Data/com.apple.CoreML/weights/weight.bin ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:62fbb250fca1e8264ed0a1220ff2fb1ad1e327058fe5b6d80e9ff1dbc1573175
3
+ size 264193088
lut8_g32_c6/lfm2_5_2_6b_lmhead.mlpackage/Manifest.json ADDED
@@ -0,0 +1,18 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ {
2
+ "fileFormatVersion": "1.0.0",
3
+ "itemInfoEntries": {
4
+ "219AE4BE-FF65-4922-A954-38FA9D3E5EB2": {
5
+ "author": "com.apple.CoreML",
6
+ "description": "CoreML Model Weights",
7
+ "name": "weights",
8
+ "path": "com.apple.CoreML/weights"
9
+ },
10
+ "79B73904-17E7-4ABE-AA7F-4FC2F92AA787": {
11
+ "author": "com.apple.CoreML",
12
+ "description": "CoreML Model Specification",
13
+ "name": "model.mlmodel",
14
+ "path": "com.apple.CoreML/model.mlmodel"
15
+ }
16
+ },
17
+ "rootModelIdentifier": "79B73904-17E7-4ABE-AA7F-4FC2F92AA787"
18
+ }
lut8_g32_c6/tokenizer.json ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:695be7802a0e4b8a81048f0ff5ebb7fc811a0ba5a6be63dbb24deb5a81096f41
3
+ size 17905598