开源
/u/Saren-WTAKO
08-31 14:04
我在单卡 GB10/DGX Spark 上运行 Qwen3.8-Flash-Next 的方案:Intel AutoRound int4 量化 + vLLM,fp8 ngram 表卸载至本地 SSD 或外部 RDMA 服务器,mtp=3、c=1 时代码生成速度约 47.5 t/s
Qwen3.8-Flash量化部署方案:INT4+vLLM跑单卡GB10
开源
Queena34
08-31 03:19
【开源】Queena34/StudyPilot:只基于你的课程资料作答、附带引用的双语AI学习教练
开源双语AI学习教练StudyPilot基于课程资料问答
行业
Barbara Moens, Financial Times
08-31 13:41
ChatGPT 和 Reddit 现在必须遵守欧盟最严格的网络安全规则
ChatGPT与Reddit被列入欧盟最严网络安全监管清单