返回搜索结果

Qwen3.8-27B · Q4_K_M

AMD Radeon RX 7900 GRE + NVIDIA GTX 1080Ti27GBllama.cpp 10453L0 自报

本页汇总 Qwen3.8-27B(Q4_K_M)在 AMD Radeon RX 7900 GRE + NVIDIA GTX 1080Ti 上以 llama.cpp 运行的 1 次实测数据,来自 1 个独立来源平台;指标为已上架实测的均值。

11.13 tok/s

Decode

解码速度

71.46 tok/s

Prefill

预填充速度

s

TTFT

首 token 延迟

17.2 GB

VRAM

显存占用

L0 自报

1

实测次数

1

独立来源

Reddit

来源平台

今天

最后验证

性能表现

  1. llama.cpp · Q6_K Decode 12.53 · Prefill 116.21 ·
  2. llama.cpp · Q4_K_M (当前)Decode 11.13 · Prefill 71.46 ·

核心数据

Decode(平均)
11.13 tok/s
Prefill(平均)
71.46 tok/s
TTFT(平均)
— s
VRAM(平均)
17.2 GB
MTP 接受率
TTFB
— GB
功耗
— W

基础配置

成员级字段取自最近一次实测

模型
Qwen3.8-27B
量化方式
Q4_K_M
框架
llama.cpp
版本
10453
Flash Attention
开启

硬件信息

标称与实测并排陈列,能否运行由读者自判

GPU
AMD Radeon RX 7900 GRE + NVIDIA GTX 1080Ti
标称显存
27 GB
实测显存(均值)
17.2 GB
系统
Ubuntu

获取与上手

启动命令

最近一次实测使用的命令
llama/llama-bench --rpc 10.0.0.75:50053 -m /Qwen3.8-27B-Q4_K_M.gguf -fa on

来源与证据

共 1 条实测记录,逐条可回溯到原始出处

  1. L0 自报Reddit原始链接 验证于 2026-09-20

    10453 · Ubuntu

    11.13 tok/s

    Decode

    71.46 tok/s

    Prefill

    s

    TTFT

    17.2 GB

    VRAM

    MTP

    W

    功耗

    RPC Radeon plus GTX 1080Ti Q4\_K using RPC |model|size|params|test|t/s| |qwen35 27B Q4\_K - Medium|15.92 GiB|27.32 B|pp512|71.46 ± 0.11| |qwen35 27B Q4\_K - Medium|15.92 GiB|27.32 B|tg128|11.13 ± 3.99| build: 3cb7ffb1a (10453) about 17.2GB VRAM but includes desktop resources about 2gb combined