← 返回信息流
行业 Reddit-LocalLLaMA · /u/koalfied-coder 2026-08-29 18:59 🔥 热度 2

DeepSeek flash v4在2台GX10s上实现67-84 tokens/s的速度

DeepSeek flash v4在2x GX10s上实现67-84 t/s性能

原文:67-84 t/s DeepSeek flash v4 off 2x GX10s

终于在使用2台gx10的情况下实现了每秒超过65个token的持续可用结果。2570提示评估对我来说也非常关键。总体来说非常激动,评分10/10。附注:我按照这个设置使用了2台华硕GX10 DGX计算机 :) https://github.com/tonyd2wild/DeepSeek-v4-Flash-0731-DSpark-1M-NVFP4-KV-2x-DGX-Spark 由/u/koalfied-coder提交 [链接] [评论]

🖼 相关图片

查看原文 ↗ 硬件算力

📌 相关阅读

Anthropic 同英伟达支持的 Lambda 签署 350 亿美元云计算协议 热度 9 算力需求释放价值红利,上市公司竞逐先进封装 热度 9 君正股份:三季度 DRAM 持续涨价且需求坚挺供应紧张,预估四季度涨价将持续 热度 9 英伟达35亿美元押注联发科,揭示其应对科技巨头自研AI芯片的布局 热度 7 对本地 模型 的偏见好像得改改了,AMD 395本地跑Qwen3.8-27B,本地 大模型 真实使用体验 热度 7