动态
发布三周,DeepSeek V4.1 Flash 衍生生态成形:GGUF 量化、abliterated 与 FP8 社区版
得益于 MIT 许可,DeepSeek V4.1 Flash 发布数小时内社区衍生版即上线:abliterated 全精度版、GGUF 本地量化版、FP8 uncensored 版(下载量最高)相继出现,另有 MixedQ2 混合量化与 forgequant 量化工具。官方未参与或背书任何衍生版本。
来源: Tech Insider
衍生版时间线
DeepSeek V4.1 Flash 于 9 月 10 日以 MIT 许可开源——允许自由修改与再分发。据追踪报道,官方发布数小时内衍生版即上线 Hugging Face,9 月 13 日前至少三个版本存活:
| 仓库 | 类型 | 备注 |
|---|---|---|
distributedcognition/DeepSeek-V4.1-Flash-abliterated |
去拒绝(abliterated)全精度版 | 截至 9 月 13 日仍在积极更新 |
vcruz305/DeepSeek-V4.1-Flash-GGUF |
GGUF 格式转换 | 供 llama.cpp 等在消费级硬件本地运行,下载流量稳定 |
dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8 |
uncensored + FP8 量化 | 模型卡标注的 ablation 日期与官方发布同日;FP8 显存占用较 FP16 约减半;保留原生多模态输入;截至 9 月下载量 2,254,为已追踪衍生版中最高 |
量化方向的新尝试
apetersson/DeepSeek-V4.1-Flash-MixedQ2-GGUF:针对路由专家的混合再量化——gate/up 用 IQ2_XXS、down 专家用 Q2_K,基于钉版 llama.cpp 量化器(PR #28696)产出- forgequant(GitHub 开源工具):配置驱动的非对称量化流水线,按专家家族指定量化类型 + imatrix,产出 GGUF,附实时 Web 面板
官方态度与风险提示
- 三个衍生版本均由独立第三方账户上传,DeepSeek 官方未创建、认可或分发任何 uncensored / abliterated 版本
- MIT 许可使这些衍生完全合法,但「合法」不等于「可靠」:去对齐版本在安全性与行为稳定性上无官方保障,下载使用请自行评估风险
- 基座模型我们已收录:DeepSeek-V4.1-Flash——衍生量化版的落地,意味着 552B 旗舰在本地硬件上的可玩性正在快速改善