Qwen3.5-35B-A3B

36B对话由 Qwen (Alibaba) 发布 发起讨论

Qwen (Alibaba) 2026-02-24 发布的开权重图文理解模型,36.0B 总参数 / 约 3B 激活,Apache-2.0 许可。MoE 架构:36B 总参数 / 约 3B 激活,适合显存受限但要更大知识池的场景。

0

量化版本

4

实测记录

量化版本

社区与官方发布的量化版本;「关联实测」只统计精确关联到该发布的实测记录。

还没有已收录的量化版本。

实测数据

共 4 组配置

硬件框架量化生成速度运行显存实测次数证据
Apple M5 Maxllama.cppQ4_K_M21.9 tok/s22.4 GB1L0 自报
NVIDIA RTX 5080 SUPERllama.cppQ5_K_M32.7 tok/s24 GB1L0 自报
NVIDIA RTX 5090vLLMQ4_K_M69.6 tok/s22.4 GB1L0 自报
NVIDIA RTX 4090llama.cppQ4_K_M35.9 tok/s22.4 GB1L0 自报

其中 4 条实测未关联到具体量化版本,完整数据见搜索页。

社区讨论

还没有讨论——发起第一个话题吧。

发起讨论