Qwen3-4B-Thinking-2507 · Q8_0
L1 ReproducedQualcomm Snapdragon X Elite · llama.cpp
GitHub
Yesterday
18.5 tok/s
Decode
2.2 tok/s
Prefill
— s
TTFT
— GB
VRAM
Config (latest run)
Windows Q8_0 llama.cpp b1-f027c4f
Sources: GitHub · 1 runs · 1 independent sources