Qwen2.5-Omni-3B

3B对话由 Qwen 发布 发起讨论

0

量化版本

18

实测记录

量化版本

社区与官方发布的量化版本;「关联实测」只统计精确关联到该发布的实测记录。

还没有已收录的量化版本。

实测数据

共 18 组配置

硬件框架量化生成速度运行显存实测次数证据
NVIDIA RTX 5060 SUPERllama.cppQ8_0109.2 tok/s3.7 GB1L0 自报
NVIDIA RTX 5060 SUPERllama.cppQ5_K_M158.8 tok/s2.7 GB1L0 自报
NVIDIA RTX 5060 SUPERllama.cppQ4_K_M194.1 tok/s2.3 GB1L0 自报
NVIDIA RTX 5070 SUPERllama.cppQ8_0218.4 tok/s3.7 GB1L0 自报
NVIDIA RTX 5070 SUPERllama.cppQ5_K_M317.7 tok/s2.7 GB1L0 自报
NVIDIA RTX 5070 SUPERllama.cppQ4_K_M388.3 tok/s2.3 GB1L0 自报
NVIDIA RTX 3090llama.cppQ8_0228.2 tok/s3.7 GB1L0 自报
NVIDIA RTX 3090llama.cppQ5_K_M331.9 tok/s2.7 GB1L0 自报
NVIDIA RTX 3090llama.cppQ4_K_M405.6 tok/s2.3 GB1L0 自报
NVIDIA RTX 5070llama.cppQ8_0163.8 tok/s3.7 GB1L0 自报
NVIDIA RTX 5070llama.cppQ5_K_M238.3 tok/s2.7 GB1L0 自报
NVIDIA RTX 5070llama.cppQ4_K_M291.2 tok/s2.3 GB1L0 自报
NVIDIA RTX 5090llama.cppQ8_0436.8 tok/s3.7 GB1L0 自报
NVIDIA RTX 5090llama.cppQ5_K_M635.3 tok/s2.7 GB1L0 自报
NVIDIA RTX 5090llama.cppQ4_K_M776.5 tok/s2.3 GB1L0 自报
NVIDIA RTX 4090llama.cppQ8_0245.7 tok/s3.7 GB1L0 自报
NVIDIA RTX 4090llama.cppQ5_K_M357.4 tok/s2.7 GB1L0 自报
NVIDIA RTX 4090llama.cppQ4_K_M436.8 tok/s2.3 GB1L0 自报

其中 18 条实测未关联到具体量化版本,完整数据见搜索页。

社区讨论

还没有讨论——发起第一个话题吧。

发起讨论