首页00月度趋势榜01新星榜02增速榜03HF热榜04总表05搜索06

froggeric/Qwen-Fixed-Chat-Templates

一个通用 drop-in 的 `chat_template.jinja` 单文件,修复官方 Qwen 聊天模板的渲染错误、KV 缓存失效、token 浪费、"空 think 污染"以及 agent 场景致命卡死等问题。Qwen3.5/3.6/3.8 用户基数巨大——Qwen 是全球下载量最大的开源模型家族之一,本地推理用户几乎人人踩过模板坑;该仓库 99 条讨论、1.48k 点赞,且 HF 对此类模板仓不追踪下载量仍能冲进热榜,基础设施级修复自带传播力。

类型
Model
热度分
199
下载量
0
Likes
1,480
许可证
未标注
在 HuggingFace 打开 回到总表

配图

信息卡

项目内容
HuggingFace 地址https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates
类型Model 仓库(Jinja 聊天模板,非模型权重)
热度分 trendingScore199(截至 2026-08-26)
许可证Apache-2.0(继承自 Qwen)
榜单HuggingFace 热榜 第15名

一句话定位

一个通用 drop-in 的 `chat_template.jinja` 单文件,修复官方 Qwen 聊天模板的渲染错误、KV 缓存失效、token 浪费、"空 think 污染"以及 agent 场景致命卡死等问题。

为什么上热度榜

Qwen3.5/3.6/3.8 用户基数巨大——Qwen 是全球下载量最大的开源模型家族之一,本地推理用户几乎人人踩过模板坑;该仓库 99 条讨论、1.48k 点赞,且 HF 对此类模板仓不追踪下载量仍能冲进热榜,基础设施级修复自带传播力。

规格与技术亮点

当前版本 v22.4(2026-08-24 更新),单个文件覆盖 Qwen 3.5 至 3.8 全部尺寸(如 Qwen3.8-27B、Qwen3.8-2.4T-A95B)。核心特性:`reasoning_effort` low/medium/xhigh 推理深度控制、`<|think_low|>` 类内联标签、工具错误两级升级警告、动态载荷截断。兼容 LM Studio、llama.cpp、vLLM、MLX/oMLX、KoboldCPP 等主流引擎。维护者为 Frédéric Guigand(@froggeric),配套 Juan Calderon-Perez 的 Fuzzer 测试套件,每次迭代经 fuzz 回归验证后合入;从 4 月创建至今打磨出二十余个版本,逐步成为社区事实标准。

使用方式与代码示例

llama.cpp:

llama-server -m your_model.gguf --jinja --chat-template-file chat_template.jinja --reasoning-format deepseek

下载模板:`huggingface-cli download --local-dir . froggeric/Qwen-Fixed-Chat-Templates`;LM Studio 在 Prompt Template 面板粘贴保存;MLX 系直接覆盖模型目录同名文件并以 `--jinja` 启动;vLLM 配合 `--reasoning-parser qwen3 --tool-call-parser qwen3_xml` 使用。

部署建议(本地/云端/量化选择)

纯模板零显存开销,任何引擎即换即用;替换后建议重点回归一轮工具调用与多轮缓存命中测试。模板随上游快速演进,自用服务建议固定 v22.4 版本号,验证稳定后再灰度升级。

典型应用场景

同类对比

官方模板是"问题源头";下游 peculiar-ragdoll/Qwen-Sharp 版在本作之上叠加精简系统提示词,风格取舍不同。

资源导航

模型卡、99 条讨论区、Fuzzer 测试套件与贡献者名单页。

← 上一篇unsloth/Qwen3.8-Flash-Next-GGUF下一篇 →ornith-ai/Ornith-1.5-9B