Qwen-AgentWorld-35B-A3B

35B对话由 Qwen 发布 发起讨论

0

量化版本

20

实测记录

量化版本

社区与官方发布的量化版本;「关联实测」只统计精确关联到该发布的实测记录。

还没有已收录的量化版本。

实测数据

共 20 组配置

硬件框架量化生成速度运行显存实测次数证据
NVIDIA RTX 5080 SUPERvLLMQ5_K_M36.6 tok/s24 GB1L0 自报
NVIDIA RTX 5080 SUPERvLLMQ4_K_M44.7 tok/s21.8 GB1L0 自报
NVIDIA RTX 5080 SUPERllama.cppQ5_K_M33.6 tok/s24 GB1L0 自报
NVIDIA RTX 5080 SUPERllama.cppQ4_K_M41 tok/s21.8 GB1L0 自报
NVIDIA RTX 5070 SUPERvLLMQ5_K_M29.3 tok/s18 GB1L0 自报
NVIDIA RTX 5070 SUPERvLLMQ4_K_M35.8 tok/s18 GB1L0 自报
NVIDIA RTX 5070 SUPERllama.cppQ5_K_M26.9 tok/s18 GB1L0 自报
NVIDIA RTX 5070 SUPERllama.cppQ4_K_M32.8 tok/s18 GB1L0 自报
NVIDIA RTX 5070 TivLLMQ5_K_M29.3 tok/s16 GB1L0 自报
NVIDIA RTX 5070 TivLLMQ4_K_M35.8 tok/s16 GB1L0 自报
NVIDIA RTX 5070 Tillama.cppQ5_K_M26.9 tok/s16 GB1L0 自报
NVIDIA RTX 5070 Tillama.cppQ4_K_M32.8 tok/s16 GB1L0 自报
NVIDIA RTX 5090vLLMQ5_K_M58.6 tok/s26.5 GB1L0 自报
NVIDIA RTX 5090vLLMQ4_K_M71.5 tok/s21.8 GB1L0 自报
NVIDIA RTX 5090llama.cppQ5_K_M53.8 tok/s26.5 GB1L0 自报
NVIDIA RTX 5090llama.cppQ4_K_M65.6 tok/s21.8 GB1L0 自报
NVIDIA RTX 4090vLLMQ5_K_M33 tok/s24 GB1L0 自报
NVIDIA RTX 4090vLLMQ4_K_M40.2 tok/s21.8 GB1L0 自报
NVIDIA RTX 4090llama.cppQ5_K_M30.2 tok/s24 GB1L0 自报
NVIDIA RTX 4090llama.cppQ4_K_M36.9 tok/s21.8 GB1L0 自报

其中 20 条实测未关联到具体量化版本,完整数据见搜索页。

社区讨论

还没有讨论——发起第一个话题吧。

发起讨论