File size: 3,974 Bytes
f541fb6
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
66
67
68
69
70
71
72
73
74
75
76
77
78
79
80
81
82
83
84
85
86
87
88
89
90
91
92
93
94
95
96
97
98
99
100
---
base_model: Qwen/Qwen3.6-27B
license: apache-2.0
license_link: https://huggingface.co/Qwen/Qwen3.6-27B/blob/main/LICENSE
language:
- zh
pipeline_tag: text-generation
library_name: llama.cpp
tags:
- gguf
- qwen3
- llama.cpp
- style-transfer
- persona
- lora
- chinese
- digital-human
datasets:
- england-lobster/zhang-xuefeng-data
---

# 张雪峰风格 27B(Qwen3.6-27B LoRA · GGUF Q4_K_M)**Qwen3.6-27B** 上做 **LoRA 风格微调**、合并权重后量化为 **GGUF Q4_K_M** 的模型,
用 llama.cpp / Ollama / LM Studio 等可直接本地运行。训练语料见
[england-lobster/zhang-xuefeng-data](https://huggingface.co/datasets/england-lobster/zhang-xuefeng-data)。

> **这是风格/人设模型,不是事实问答模型。** 目标是"说话像张雪峰"(口语节奏、口头禅、直播语气),
> 作为数字人直播底座;**事实应由下游 RAG/台本注入**。模型输出**不代表张雪峰本人观点**,也不保证事实准确。

## ⚠️ 使用与合规声明(务必先读)

- 本模型能以张雪峰的**语气/人设**生成中文文本。**底层人设/肖像权益属于本人**- 仅供**学术研究与技术交流**。请勿用于:冒充本人、虚假代言/带货、诈骗、误导性宣传,或任何可能侵犯
  其人格权/造成公众混淆的场景。是否可用于商用请**自行评估并取得授权**,因使用本模型产生的责任由使用者承担。
- 输出可能包含 ASR/训练引入的错误信息,**不应作为升学/报考的事实依据**- 如权利人提出异议,请联系仓库维护者下线。

## 文件

| 文件 | 量化 | 大小 | 说明 |
|---|---|---|---|
| `qwen36_27b_style_lora_merged.Q4_K_M.gguf` | Q4_K_M | ~16.8 GB | 合并权重的 4-bit K-quant,质量/体积平衡,主流选择 |

## 模型规格

- 基座:**Qwen/Qwen3.6-27B**(27B,65 层,hidden 5120,GQA 24/4 头,上下文 262144)
- 微调:LoRA(r=32, α=64, lr 8e-5, 1 epoch, max_len 4096;**仅对最后一个 assistant turn 计 loss**
- 量化:GGUF v3,Q4_K_M(`general.file_type=15`)
- 基座许可:Apache-2.0(见 `license_link`## 快速使用

**llama.cpp**

```bash
# 下载
huggingface-cli download england-lobster/zhang-xuefeng-27b-gguf \
  qwen36_27b_style_lora_merged.Q4_K_M.gguf --local-dir .

# 运行(Qwen3 chat 模板,llama.cpp 内置)
./llama-cli -m qwen36_27b_style_lora_merged.Q4_K_M.gguf \
  -p "孩子分数刚过一本线,想报计算机,但担心就业,老师怎么看?" \
  -c 8192 -ngl 99
```

**Ollama**

```bash
# Modelfile
printf 'FROM ./qwen36_27b_style_lora_merged.Q4_K_M.gguf\nPARAMETER temperature 0.8\nSYSTEM 你是张雪峰,按张雪峰本人风格回答升学规划、专业选择、就业和考研相关问题。\n' > Modelfile
ollama create zxf-27b -f Modelfile
ollama run zxf-27b "新高考选科,物化生和物化地怎么选?"
```

建议 system prompt:`你是张雪峰,按张雪峰本人风格回答升学规划、专业选择、就业和考研相关问题。`
(与训练时一致);采样 `temperature≈0.7–0.9` 能更好还原直播口语节奏。

## 已知局限

- **会保留直播带货语气**(训练集约 57% 为带货语域):纯问答场景可能出现"报链接/催单"式表达。
- **事实不可靠**:ASR 转写 + 风格优先,会有同音/事实错误,请勿据此做报考决策。
- **口语 ≠ 规整**:口头禅、重复、中英夹杂是有意保留的风格特征,不是 bug。

## 训练数据

[england-lobster/zhang-xuefeng-data](https://huggingface.co/datasets/england-lobster/zhang-xuefeng-data)
(5411 条,merged_turn 视图,按直播场次切分无泄漏)。

## 引用

```bibtex
@misc{zhang_xuefeng_style_27b_gguf,
  title  = {张雪峰风格 27B (Qwen3.6-27B LoRA, GGUF Q4_K_M)},
  author = {england-lobster},
  year   = {2026},
  howpublished = {\url{https://huggingface.co/england-lobster/zhang-xuefeng-27b-gguf}}
}
```