开源
/u/AdventurousSwim1312
08-31 10:22
Qwen3.8-Next-Flash 在单张 rtx 6000 pro 上达到 240 token/s
优化版sglang使Qwen3.8-Next-Flash达240t/s
模型
/u/t4a8945
08-31 10:13
deepseek-ai/DeepSeek-V4-Flash-Vision-Exp · Hugging Face
DeepSeek发布V4-Flash-Vision-Exp多模态模型
开源
/u/paf1138
08-31 09:51
pipecat-ai/phonellm-alpha-1:在典型语音智能体任务上达到 GPT 5.6 Terra 水平,延迟仅为其 1/3,成本仅为其 1/18
pipecat开源语音模型,低成本低延迟对标GPT5.6
行业
/u/SnoozeDoggyDog
08-31 13:36
揭秘 Meta 推动机器人进驻数据中心上班的计划 | 该公司正在测试让机器人执行技术人员所能完成的任务
Meta测试机器人执行数据中心技术员任务
开源
/u/Kernoriordan
08-31 09:34
我是如何让 Qwen 3.8 27B 在 16GB RTX 5080 上跑出约 75 tokens/s 解码速度的
网友在16GB RTX 5080上让Qwen 27B达到75t/s解码