← 返回信息流
行业 Reddit-LocalLLaMA · /u/jacek2023 2026-08-31 18:53 🔥 热度 5

AVX2:通过 bartowski1182 的 PR 加速 IQ 模型大批量提示处理 · Pull Request #27402 · ggml-org/llama.cpp

llama.cpp新PR通过AVX2加速CPU大批量提示处理

原文:AVX2: Speed up large batch size prompt processing of IQ models by bartowski1182 · Pull Request #27402 · ggml-org/llama.cpp

Faster prompt processing on CPU. submitted by /u/jacek2023 [link] [comments]

⚡ 这是一条快讯:原文内容较短,点下方按钮直达原始链接获取完整信息

🖼 相关图片

查看原文 ↗ 开源项目硬件算力

📌 相关阅读

我们拆了 1.1 万个 DeepSeek Harness 插件,发现官方几乎没有建立插件治理机制 热度 26 【开源】Player-YN/PawWork_ZhuaZhua:Paw Work——面向 Chrome 的“先选中”网页代理 热度 10 扬电科技:全资子公司已完成32个算力节点的交付且验收通过,该批节点今起正式计费 热度 9 韩国政府拟首次直接采用民营数据中心GPU服务 热度 9 GitHub最热架构图Agent,开发者故事看哭了 热度 9