论文
作者:Hemant Kumar Mahato, Łukasz Sieczkowski, Vijayasenthilkumar K
08-31 16:45
智能体适应度函数:将演进式架构扩展至确定性规则之外
提出智能体适应度函数扩展演进式架构规则
论文
/u/-MaskNinja-
08-31 12:42
如果禁用 H-Neurons,Qwen3.8-27B 或 GLM-5.3-Flash 这类模型会变得多差?
新论文提出禁用神经元以降低模型幻觉率
论文
/u/9r4n4y
08-30 12:45
基于HBF的有趣论文[2607.10186] FlashAccel:利用高带宽闪存(HBF)实现高吞吐量LLM推理
FlashAccel利用HBF提升LLM推理吞吐量
论文
IT之家
08-30 07:48
因缺少 MTE 安全功能,GrapheneOS 当前阶段放弃适配谷歌 Pixel 11 系列手机
GrapheneOS 因安全功能问题放弃适配 Pixel 11
论文
/u/Artistic_Okra7288
08-30 03:56
在128GB M5 Max上以350K上下文运行Qwen3.8-Flash-Next(79 GB,2-bit)3.5小时——速度与上下文深度,100次对话,一个图表
Qwen3.8-Flash-Next在长上下文任务中的性能测试
论文
/u/Daxfortuna
08-29 23:27
Nemotron-3.5-Lightning达到11.77 GiB,为没有16 GB选项的模型提供了一种选择
Nemotron-3.5-Lightning发布16GB版本
论文
/u/serige
08-29 23:18
在2x DGX Spark配置下对Deepseek V4 Flash 0731与GLM5.3 Flash进行Humaneval基准测试
DeepSeek V4与GLM5.3性能对比
论文
IT之家
08-30 01:37
谷歌确认开发 WSL 支持:Antigravity 将直连 Win11 Linux 环境
谷歌开发WSL支持,Antigravity将直连Win11 Linux环境
论文
/u/Littlepharaoh
08-29 18:24
(NInfer分支) 我希望拥有一个支持100万上下文窗口的Qwen-3.8 27B模型,使用tp2和双5090显卡
NInfer Fork支持Qwen-3.8 27B双GPU推理
论文
/u/RedditUsr2
08-29 14:31
腾讯将Hy4-preview从1.5TB压缩至约200GB GGUF,同时保持了约98%的性能
腾讯压缩Hy4-preview模型至200GB
第 1 / 2 页
下一页 →