一个通用 drop-in 的 `chat_template.jinja` 单文件,修复官方 Qwen 聊天模板的渲染错误、KV 缓存失效、token 浪费、"空 think 污染"以及 agent 场景致命卡死等问题。Qwen3.5/3.6/3.8 用户基数巨大——Qwen 是全球下载量最大的开源模型家族之一,本地推理用户几乎人人踩过模板坑;该仓库 99 条讨论、1.48k 点赞,且 HF 对此类模板仓不追踪下载量仍能冲进热榜,基础设施级修复自带传播力。

| 项目 | 内容 |
|---|---|
| HuggingFace 地址 | https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates |
| 类型 | Model 仓库(Jinja 聊天模板,非模型权重) |
| 热度分 trendingScore | 199(截至 2026-08-26) |
| 许可证 | Apache-2.0(继承自 Qwen) |
| 榜单 | HuggingFace 热榜 第15名 |
一个通用 drop-in 的 `chat_template.jinja` 单文件,修复官方 Qwen 聊天模板的渲染错误、KV 缓存失效、token 浪费、"空 think 污染"以及 agent 场景致命卡死等问题。
Qwen3.5/3.6/3.8 用户基数巨大——Qwen 是全球下载量最大的开源模型家族之一,本地推理用户几乎人人踩过模板坑;该仓库 99 条讨论、1.48k 点赞,且 HF 对此类模板仓不追踪下载量仍能冲进热榜,基础设施级修复自带传播力。
当前版本 v22.4(2026-08-24 更新),单个文件覆盖 Qwen 3.5 至 3.8 全部尺寸(如 Qwen3.8-27B、Qwen3.8-2.4T-A95B)。核心特性:`reasoning_effort` low/medium/xhigh 推理深度控制、`<|think_low|>` 类内联标签、工具错误两级升级警告、动态载荷截断。兼容 LM Studio、llama.cpp、vLLM、MLX/oMLX、KoboldCPP 等主流引擎。维护者为 Frédéric Guigand(@froggeric),配套 Juan Calderon-Perez 的 Fuzzer 测试套件,每次迭代经 fuzz 回归验证后合入;从 4 月创建至今打磨出二十余个版本,逐步成为社区事实标准。
llama.cpp:
llama-server -m your_model.gguf --jinja --chat-template-file chat_template.jinja --reasoning-format deepseek
下载模板:`huggingface-cli download --local-dir . froggeric/Qwen-Fixed-Chat-Templates`;LM Studio 在 Prompt Template 面板粘贴保存;MLX 系直接覆盖模型目录同名文件并以 `--jinja` 启动;vLLM 配合 `--reasoning-parser qwen3 --tool-call-parser qwen3_xml` 使用。
纯模板零显存开销,任何引擎即换即用;替换后建议重点回归一轮工具调用与多轮缓存命中测试。模板随上游快速演进,自用服务建议固定 v22.4 版本号,验证稳定后再灰度升级。
官方模板是"问题源头";下游 peculiar-ragdoll/Qwen-Sharp 版在本作之上叠加精简系统提示词,风格取舍不同。
模型卡、99 条讨论区、Fuzzer 测试套件与贡献者名单页。