← 返回信息流
行业 Reddit-LocalLLaMA · /u/Ok_Warning2146 2026-08-31 11:29 🔥 热度 6

为 M5 Ultra 512GB 预先下载哪些模型?

用户为M5 Ultra 512GB挑选本地部署模型

原文:Models to download for M5 Ultra 512GB

我刚下单了 TB5 扩展坞和 4TB SSD,为 M5 Ultra 512GB 做准备。我计划提前下载以下模型。想请教 M3 Ultra 512GB 的用户:在 512GB 的限制下,这些量化版本是不是表现"最优"的?GLM-5.3 和 Kimi-K3 最多能跑到多长的上下文?如果方便的话,能贴一下它们的 pp 和 tg 速度吗?对 glm-5.3-flash、qwen3.8-flash-next 和 DSV4F 跑 8-bit 模型有意义吗?还有其他值得下载的大模型吗?非常感谢提前。模型及内存占用:pipenetwork/GLM-5.3-MLX-mixed-4_8bit 427.8GB;pipenetwork/GLM-5.3-Flash-MLX-mixed-4_8bit 181.9GB;pipenetwork/Qwen3.8-Flash-Next-MLX-mixed-4_8bit 106.2GB;pipenetwork/DeepSeek-V4-Flash-MLX-mixed-4_8bit 165GB;pipenetwork/Kimi-K3-REAP73-MLX-mxfp4-q8 451GB

查看原文 ↗ 硬件算力

📌 相关阅读

英伟达35亿美元押注联发科,揭示其应对科技巨头自研AI芯片的布局 热度 8 对本地 模型 的偏见好像得改改了,AMD 395本地跑Qwen3.8-27B,本地 大模型 真实使用体验 热度 8 范式与华为达成重磅算力战略合作,成为首批拥抱国产最高端算力底座的AI企业 热度 7 部分高端算力企业订单排至3年后 热度 7 OpenAI买几万台Mac搞强化训练!英伟达的活被苹果抢了 热度 7