返回搜索结果

Qwen3.8-27B · Q6_K

AMD Radeon RX 7900 GRE + NVIDIA GTX 1080Ti27GBllama.cpp 10453L0 自报

本页汇总 Qwen3.8-27B(Q6_K)在 AMD Radeon RX 7900 GRE + NVIDIA GTX 1080Ti 上以 llama.cpp 运行的 1 次实测数据,来自 1 个独立来源平台;指标为已上架实测的均值。

12.53 tok/s

Decode

解码速度

116.21 tok/s

Prefill

预填充速度

s

TTFT

首 token 延迟

23 GB

VRAM

显存占用

L0 自报

1

实测次数

1

独立来源

Reddit

来源平台

今天

最后验证

性能表现

  1. llama.cpp · Q6_K (当前)Decode 12.53 · Prefill 116.21 ·
  2. llama.cpp · Q4_K_M Decode 11.13 · Prefill 71.46 ·

核心数据

Decode(平均)
12.53 tok/s
Prefill(平均)
116.21 tok/s
TTFT(平均)
— s
VRAM(平均)
23 GB
MTP 接受率
TTFB
— GB
功耗
— W

基础配置

成员级字段取自最近一次实测

模型
Qwen3.8-27B
量化方式
Q6_K
框架
llama.cpp
版本
10453

硬件信息

标称与实测并排陈列,能否运行由读者自判

GPU
AMD Radeon RX 7900 GRE + NVIDIA GTX 1080Ti
标称显存
27 GB
实测显存(均值)
23 GB
系统
Ubuntu

来源与证据

共 1 条实测记录,逐条可回溯到原始出处

  1. L0 自报Reddit原始链接 验证于 2026-09-20

    10453 · Ubuntu

    12.53 tok/s

    Decode

    116.21 tok/s

    Prefill

    s

    TTFT

    23 GB

    VRAM

    MTP

    W

    功耗

    Radeon plus GTX 1080Ti Q6\_K using RPC |qwen35 27B Q6\_K|21.30 GiB|27.32 B|pp512|116.21 ± 0.55| |qwen35 27B Q6\_K|21.30 GiB|27.32 B|tg128|12.53 ± 0.02| build: 3cb7ffb1a (10453) Almost 23gb VRAM used about 2gb for combined desktop resources