← 新闻
动态

发布三周,DeepSeek V4.1 Flash 衍生生态成形:GGUF 量化、abliterated 与 FP8 社区版

得益于 MIT 许可,DeepSeek V4.1 Flash 发布数小时内社区衍生版即上线:abliterated 全精度版、GGUF 本地量化版、FP8 uncensored 版(下载量最高)相继出现,另有 MixedQ2 混合量化与 forgequant 量化工具。官方未参与或背书任何衍生版本。

来源: Tech Insider

衍生版时间线

DeepSeek V4.1 Flash 于 9 月 10 日以 MIT 许可开源——允许自由修改与再分发。据追踪报道,官方发布数小时内衍生版即上线 Hugging Face,9 月 13 日前至少三个版本存活:

仓库 类型 备注
distributedcognition/DeepSeek-V4.1-Flash-abliterated 去拒绝(abliterated)全精度版 截至 9 月 13 日仍在积极更新
vcruz305/DeepSeek-V4.1-Flash-GGUF GGUF 格式转换 供 llama.cpp 等在消费级硬件本地运行,下载流量稳定
dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8 uncensored + FP8 量化 模型卡标注的 ablation 日期与官方发布同日;FP8 显存占用较 FP16 约减半;保留原生多模态输入;截至 9 月下载量 2,254,为已追踪衍生版中最高

量化方向的新尝试

  • apetersson/DeepSeek-V4.1-Flash-MixedQ2-GGUF:针对路由专家的混合再量化——gate/up 用 IQ2_XXS、down 专家用 Q2_K,基于钉版 llama.cpp 量化器(PR #28696)产出
  • forgequant(GitHub 开源工具):配置驱动的非对称量化流水线,按专家家族指定量化类型 + imatrix,产出 GGUF,附实时 Web 面板

官方态度与风险提示

  • 三个衍生版本均由独立第三方账户上传,DeepSeek 官方未创建、认可或分发任何 uncensored / abliterated 版本
  • MIT 许可使这些衍生完全合法,但「合法」不等于「可靠」:去对齐版本在安全性与行为稳定性上无官方保障,下载使用请自行评估风险
  • 基座模型我们已收录:DeepSeek-V4.1-Flash——衍生量化版的落地,意味着 552B 旗舰在本地硬件上的可玩性正在快速改善