KartoffelToby lordx64 commited on
Commit
977ab20
·
0 Parent(s):

Duplicate from lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled-Q8_0-GGUF

Browse files
.gitattributes ADDED
@@ -0,0 +1,36 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ *.7z filter=lfs diff=lfs merge=lfs -text
2
+ *.arrow filter=lfs diff=lfs merge=lfs -text
3
+ *.bin filter=lfs diff=lfs merge=lfs -text
4
+ *.bz2 filter=lfs diff=lfs merge=lfs -text
5
+ *.ckpt filter=lfs diff=lfs merge=lfs -text
6
+ *.ftz filter=lfs diff=lfs merge=lfs -text
7
+ *.gz filter=lfs diff=lfs merge=lfs -text
8
+ *.h5 filter=lfs diff=lfs merge=lfs -text
9
+ *.joblib filter=lfs diff=lfs merge=lfs -text
10
+ *.lfs.* filter=lfs diff=lfs merge=lfs -text
11
+ *.mlmodel filter=lfs diff=lfs merge=lfs -text
12
+ *.model filter=lfs diff=lfs merge=lfs -text
13
+ *.msgpack filter=lfs diff=lfs merge=lfs -text
14
+ *.npy filter=lfs diff=lfs merge=lfs -text
15
+ *.npz filter=lfs diff=lfs merge=lfs -text
16
+ *.onnx filter=lfs diff=lfs merge=lfs -text
17
+ *.ot filter=lfs diff=lfs merge=lfs -text
18
+ *.parquet filter=lfs diff=lfs merge=lfs -text
19
+ *.pb filter=lfs diff=lfs merge=lfs -text
20
+ *.pickle filter=lfs diff=lfs merge=lfs -text
21
+ *.pkl filter=lfs diff=lfs merge=lfs -text
22
+ *.pt filter=lfs diff=lfs merge=lfs -text
23
+ *.pth filter=lfs diff=lfs merge=lfs -text
24
+ *.rar filter=lfs diff=lfs merge=lfs -text
25
+ *.safetensors filter=lfs diff=lfs merge=lfs -text
26
+ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
27
+ *.tar.* filter=lfs diff=lfs merge=lfs -text
28
+ *.tar filter=lfs diff=lfs merge=lfs -text
29
+ *.tflite filter=lfs diff=lfs merge=lfs -text
30
+ *.tgz filter=lfs diff=lfs merge=lfs -text
31
+ *.wasm filter=lfs diff=lfs merge=lfs -text
32
+ *.xz filter=lfs diff=lfs merge=lfs -text
33
+ *.zip filter=lfs diff=lfs merge=lfs -text
34
+ *.zst filter=lfs diff=lfs merge=lfs -text
35
+ *tfevents* filter=lfs diff=lfs merge=lfs -text
36
+ Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled.Q8_0.gguf ADDED
@@ -0,0 +1,3 @@
 
 
 
 
1
+ version https://git-lfs.github.com/spec/v1
2
+ oid sha256:5186ec1d401a26ebc93e9e24e2c67554c26a572fe28e0ae1447e426acc32e8dd
3
+ size 36903140096
README.md ADDED
@@ -0,0 +1,60 @@
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
+ ---
2
+ base_model: lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled
3
+ library_name: gguf
4
+ pipeline_tag: text-generation
5
+ tags:
6
+ - gguf
7
+ - llama.cpp
8
+ - lmstudio
9
+ - reasoning
10
+ - chain-of-thought
11
+ - qwen
12
+ - qwen3.6
13
+ - moe
14
+ - distillation
15
+ quantized_by: lordx64
16
+ license: apache-2.0
17
+ ---
18
+
19
+ # Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled-Q8_0-GGUF
20
+
21
+ GGUF quantizations of [`lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled`](https://huggingface.co/lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled) for
22
+ use with [llama.cpp](https://github.com/ggerganov/llama.cpp) and
23
+ [LM Studio](https://lmstudio.ai/).
24
+
25
+ The base model is a reasoning-distilled variant of Qwen3.6-35B-A3B fine-tuned
26
+ to imitate the chain-of-thought style of Claude Opus 4.7. It thinks in explicit
27
+ `<think>...</think>` blocks before producing the final answer.
28
+
29
+ ## Quant files
30
+
31
+ See the file list for all available quant levels. Common choices:
32
+
33
+ | File | Quant | Approx size | Use case |
34
+ |---|---|---|---|
35
+ | `*.IQ4_XS.gguf` | IQ4_XS | ~18 GB | Smallest quant with good quality — default pick for LM Studio |
36
+ | `*.Q4_K_M.gguf` | Q4_K_M | ~21 GB | Balanced quality / size |
37
+ | `*.Q5_K_M.gguf` | Q5_K_M | ~25 GB | Higher quality |
38
+ | `*.Q8_0.gguf` | Q8_0 | ~35 GB | Near-lossless |
39
+
40
+ ## Running in llama.cpp
41
+
42
+ ```bash
43
+ llama-server \
44
+ -m Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled.IQ4_XS.gguf \
45
+ --host 127.0.0.1 --port 18081 \
46
+ -c 32768 -fa on \
47
+ --cache-type-k q8_0 --cache-type-v turbo4
48
+ ```
49
+
50
+ ## Running in LM Studio
51
+
52
+ Search for `lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled-Q8_0-GGUF` inside LM Studio's model browser and pick the quant
53
+ that fits your RAM/VRAM. The model should appear automatically once HF indexes
54
+ this repo.
55
+
56
+ ## License
57
+
58
+ Apache 2.0, inherited from the base model. See
59
+ [`lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled`](https://huggingface.co/lordx64/Qwen3.6-35B-A3B-Claude-4.7-Opus-Reasoning-Distilled) for training details,
60
+ evaluations, and intended use.