Add v79 (Hexagon v79 / SM8750, S25) bundle
#1
by Aman0runanywhere - opened
- .gitattributes +1 -0
- v79/qwen06_decn1k_w8.bin +3 -0
- v79/qwen06_embed_f16.bin +3 -0
- v79/qwen06_lmh_w8.bin +3 -0
- v79/qwen06_pf_f16.bin +3 -0
- v79/qwen3-0.6b-1024final.json +28 -0
- v79/tokenizer.json +3 -0
.gitattributes
CHANGED
|
@@ -34,3 +34,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
v81/tokenizer.json filter=lfs diff=lfs merge=lfs -text
|
|
|
|
|
|
| 34 |
*.zst filter=lfs diff=lfs merge=lfs -text
|
| 35 |
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
| 36 |
v81/tokenizer.json filter=lfs diff=lfs merge=lfs -text
|
| 37 |
+
v79/tokenizer.json filter=lfs diff=lfs merge=lfs -text
|
v79/qwen06_decn1k_w8.bin
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:ff658f9eb05d12848f0437805de345bf4b48979108f8085742051c95e1c5c294
|
| 3 |
+
size 445333504
|
v79/qwen06_embed_f16.bin
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:616f9374ddbaae3a033a0174557d502719154882e21e5d975ab5b58e0244459d
|
| 3 |
+
size 311164928
|
v79/qwen06_lmh_w8.bin
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:da3a1bb48125de01d22e5d03297dda2b0fa2dc88c0296890a501a6d6c204812f
|
| 3 |
+
size 157868032
|
v79/qwen06_pf_f16.bin
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:baff8ecde24c94c2fbc25548c6829246d91feae738d4f4eced78c7df646e2840
|
| 3 |
+
size 895508480
|
v79/qwen3-0.6b-1024final.json
ADDED
|
@@ -0,0 +1,28 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
{
|
| 2 |
+
"schema_version": 1,
|
| 3 |
+
"_comment": "Standalone Qwen3-0.6B native QHexRT LLM (Halo brain). 16q/8kv, head_dim 128, QK-norm, 1D RoPE theta 1e6, tied lm-head; 16-head materialized attention runs coherently at MAXCTX. decode qwen06_decn1k_w8 (w8, 1024) + NPU tied lm-head (qwen06_lmh_w8) + host embed + full-dim 1D RoPE + cmask + sliding-window KV ring, driven by qwen3_generate. The `chat` block below makes templating runtime-owned (ChatML) and DISABLES Qwen3 thinking via an empty <think></think> assistant prefix (matches Halo's device-validated tool/chat prompt).",
|
| 4 |
+
"model": { "name": "qwen3-0.6b-1024final", "family": "llm", "dsp_arch": "v79", "tokenizer_pre": "qwen2" },
|
| 5 |
+
"params": {
|
| 6 |
+
"hidden": 1024, "vocab": 151936, "n_layers": 28, "max_ctx": 1024,
|
| 7 |
+
"kv_dim": 1024, "head_dim": 128, "rope_theta": 1000000.0, "eos_token_id": 151645
|
| 8 |
+
},
|
| 9 |
+
"artifacts": {
|
| 10 |
+
"contexts": {
|
| 11 |
+
"prefill": { "bin": "qwen06_pf_f16.bin" }, "decode": { "bin": "qwen06_decn1k_w8.bin" },
|
| 12 |
+
"lmhead": { "bin": "qwen06_lmh_w8.bin" }
|
| 13 |
+
},
|
| 14 |
+
"embed": "qwen06_embed_f16.bin",
|
| 15 |
+
"tokenizer": "tokenizer.json"
|
| 16 |
+
},
|
| 17 |
+
"chat": {
|
| 18 |
+
"system": { "prefix": "<|im_start|>system\n", "suffix": "<|im_end|>\n" },
|
| 19 |
+
"user": { "prefix": "<|im_start|>user\n", "suffix": "<|im_end|>\n" },
|
| 20 |
+
"assistant": { "prefix": "<|im_start|>assistant\n<think>\n\n</think>\n\n", "suffix": "<|im_end|>\n" }
|
| 21 |
+
},
|
| 22 |
+
"plan": {
|
| 23 |
+
"steps": [
|
| 24 |
+
{ "host": "qwen3_generate",
|
| 25 |
+
"params": { "prefill": "qwen06_pf_f16", "decode": "qwen06_decn1k_w8", "lmhead": "qwen06_lmh_w8", "max_new": 64, "neg": -50000 } }
|
| 26 |
+
]
|
| 27 |
+
}
|
| 28 |
+
}
|
v79/tokenizer.json
ADDED
|
@@ -0,0 +1,3 @@
|
|
|
|
|
|
|
|
|
|
|
|
|
| 1 |
+
version https://git-lfs.github.com/spec/v1
|
| 2 |
+
oid sha256:be75606093db2094d7cd20f3c2f385c212750648bd6ea4fb2bf507a6a4c55506
|
| 3 |
+
size 11422650
|