首页00月度趋势榜01新星榜02增速榜03HF热榜04总表05搜索06

unsloth/Qwen3.8-27B-NVFP4

Unsloth AI 对 Qwen3.8-27B 施加 Dynamic V3.0 NVFP4 校准策略的高性价比量化发行版——本仓不含新训练工作,主体架构与技术分析均指向 Qwen 官方基座 Qwen/Qwen3.8-27B;发行价值在于让 22.6GB 的四比特包吃满 Blackwell 显卡原生气势。核心能力围绕量化分布、基座亮点(归属Qwen官方)展开。

类型
Model
热度分
85
下载量
1,742,690
Likes
369
许可证
未标注
在 HuggingFace 打开 回到总表

配图

信息卡

项目内容
HuggingFace 地址https://huggingface.co/unsloth/Qwen3.8-27B-NVFP4
类型Model
热度分 trendingScore85(截至 2026-08-26)
许可证Apache-2.0
榜单HuggingFace 热榜 L4 第38名

一句话定位

Unsloth AI 对 Qwen3.8-27B 施加 Dynamic V3.0 NVFP4 校准策略的高性价比量化发行版——本仓不含新训练工作,主体架构与技术分析均指向 Qwen 官方基座 Qwen/Qwen3.8-27B;发行价值在于让 22.6GB 的四比特包吃满 Blackwell 显卡原生气势。

为什么上热度榜

基座 Qwen3.8-27B 发布后已有 800+ 社区量化,竞争白热化;Unsloth 以 NVIDIA 原生 FP4 格式 + Dynamic V3.0 逐层保留关键高精度权重的方式抢下质量标杆位,上架两周月下载突破 174 万(369 点赞),成为 vLLM 用户装机的默认选择之一。

规格与技术亮点

使用方式与代码示例

from unsloth import FastModel
model, tokenizer = FastModel.from_pretrained(
    model_name="unsloth/Qwen3.8-27B-NVFP4",
    max_seq_length=2048,
)

也可 `vllm serve` 直接加载;或用 Unsloth Studio 本地界面(curl 安装脚本后 `unsloth studio`)。推荐采样:思考模式 temp=1.0/top_p=0.95/top_k=20,非思考模式 temp=0.7/presence_penalty=1.5。

部署建议(本地/云端/量化选择)

NVFP4 是 NVIDIA Blackwell 架构原生格式,RTX 5090/B200 类硬件加速收益最大,旧架构会退化为软件模拟、性价比打折;24GB 卡放得下本体但长上下文需压缩 KV 配置。追求兼容性选 GGUF 版本,追求吞吐选本包配 vLLM。

典型应用场景

同类对比

比 GGUF Q4_K_M 走 vLLM 服务路径吞吐更高;比 AWQ/GPTQ 传统四比特方案困惑度损失更小(Dynamic 逐层保精度);同系列还有 Q4/Q8 等梯度可选,Hopper/旧卡用户应退回相应版本。

资源导航

官方基座:Qwen/Qwen3.8-27B|Unsloth Dynamic V3.0 说明与其 NVFP4 Collection(11 项)|进一步量化派生 7 个、微调派生 1 个。

← 上一篇Saravutw/Omni-videos-custom下一篇 →meta-models/Muse-Glimmer-30B