搜索实测数据

试试这些搜索

找到 2 条相关运行记录

模型Qwen3.6-27B硬件 全部框架 全部量化 全部证据等级 全部来源平台 全部

Qwen3.6-27B · Q5_K_S

L0 自报

NVIDIA RTX 3090 · 24GB · llama.cpp

GitHub

今天

46.57 tok/s

Decode

1,201.22 tok/s

Prefill

0.1 s

TTFT

21.53 GB

VRAM

配置(最近一次实测):

Debian GNU/Linux 13 (trixie) CUDA 13.3 Q5_K_S llama.cpp v0.3.0-e0663be2713c

来源:GitHub · 1 次实测 · 1 个独立来源

Qwen3.6-27B · Q5_K_S

L0 自报

NVIDIA RTX 3090 Ti · 24GB · llama.cpp

GitHub

今天

50.84 tok/s

Decode

1,376.9 tok/s

Prefill

0.09 s

TTFT

22.47 GB

VRAM

配置(最近一次实测):

Ubuntu 24.04.4 LTS CUDA 13.0 Q5_K_S llama.cpp v0.3.0-e0663be2713c

来源:GitHub · 1 次实测 · 1 个独立来源

共 2 条结果