--- language: - zh - en license: mit ---
HERETIC 1.4.0MTPAPEXMIT

Ornith-1.0-35B-Heretic-MTP-APEX

English README | 中文文档

Heretic Trial 63 BF16 合并 · 兼容 MTP 预测头 · APEX GGUF + mmproj

🐦 关于此版本

Ornith-1.0-35B 是 DeepReinforce AI 基于 Qwen3.5 MoE 的智能体编程模型。本实验版本将 Heretic 1.4.0 选出的 Trial 63 LoRA 合并到了 BF16 权重。

它还包含兼容的 Qwen3.5 MTP 预测头、BF16 视觉投影器和 APEX 混合精度 GGUF。修改拒答行为的模型可能与原版不同,部署前请自行评估。许可证:MIT。

🧠 模型详情
架构Qwen3.5 MoE,多模态
参数 / 专家总计 35B;每 token 激活 3B · 256 专家,激活 8 个
层数40 个 Transformer 层 + 1 个 MTP 层(785 个 BF16 tensor)
上下文262,144 tokens
权重BF16 safetensors,17 个分片;LoRA 合并已审计
Heretic Trial 63 / 120

选定参数:direction_index=21.66;注意力 o_proj 范围 1.55–2.05;MLP down_proj 范围 1.64–1.84。

拒答预筛 / 完整评估2 / 30 · 11 / 100
验证 KL mean / p95 / max0.0242 / 0.1477 / 0.1648
生成健康检查通过 · Top-1 不一致率 2.0%
📊 BenchLocal 结果(APEX-I-Compact)
模式ToolCallBugFindHermesAgent上限 / 实用
思考 ↗100988995.0 / 90.0
无思考 ↗97978592.2 / 76.2

最新结果卡:思考模式重试扣分 5 分;无思考模式重试扣分 16 分。

🚀 使用

hf download SC117/Ornith-1.0-35B-Heretic-MTP-APEX-GGUF --include "*.gguf" --local-dir ./models ./llama-server -m ./models/Ornith-1.0-35B-Heretic-MTP-APEX-I-Compact.gguf --mmproj ./models/mmproj-Ornith-1.0-35B-Heretic-MTP-BF16.gguf -ngl 99 -c 131072

🎛️ 推荐参数
通用 / 编程: temperature=0.6, top_p=0.95, top_k=20
💡 什么是 APEX?
这些 GGUF 使用 APEX MoE 感知混合精度量化。精度按张量角色和层位置分配;MTP 层保持 Q8_0,匹配的视觉投影器保持 BF16。
📦 APEX 量化档位
文件大小适用场景
*-APEX-I-Quality.gguf21.87 GiB最高质量
*-APEX-I-Balanced.gguf24.33 GiB全能推荐
*-APEX-I-Compact.gguf16.14 GiB质量 / 体积比
*-APEX-I-Mini.gguf13.29 GiB最紧凑
## 链接 - **原始模型**: https://huggingface.co/deepreinforce-ai/Ornith-1.0-35B - **Heretic**: https://github.com/p-e-w/heretic - **APEX Quantization**: https://github.com/mudler/apex-quant - **BenchLocal Results**: https://scorp1o117.github.io/benchlocal-results/