行业
/u/FantasticNature7590
08-31 20:17
Qwen3.8-Flash-Next 在 llama.cpp 中从纯 CPU 到 96GB 显存:8.5 到 109 tok/s,最大上下文与参数实测。我在 RTX 6000 PRO 上的发现
Qwen3.8-Flash在llama.cpp上CPU至96GB显存的推理速度实测












