论文
/u/qaf23
08-29 12:50
在 16GB GPU 上以 50 tok/s 运行 Qwen 3.8 27B 并支持 10 万上下文(beellama.cpp)
Qwen 3.8 27B模型在16GB GPU上实现高效运行
Qwen 3.8 27B模型在16GB GPU上实现高效运行
Cloudflare优化DNS缓存节省100TB内存