← 返回信息流
模型 Reddit-OpenAI · /u/coursiv_ 2026-08-31 22:21 🔥 热度 4

OpenAI 暂停强化学习训练两周,并为 Astra 的网络安全层级评估增加了监控算力成本

OpenAI暂停RL训练两周并增加Astra监控算力

原文:OpenAI paused RL training for two weeks and added a monitoring compute cost over Astra's cyber tier reading

抛开发布日期的猜测不谈,Astra 事件中信息量最大的部分反而在这里讨论得最少。OpenAI 表示,它将 Astra 视为第一个无法排除达到其自身准备框架中“关键”网络安全阈值的模型。不是确认达到该层级,而是无法排除。此前没有任何模型被评为高于其下一层级。接下来的部分才有意思。面向部署的模型的强化学习被暂停了两周。研究环境被加固并进行了红队测试。监控被扩大,被监控工作负载的算力成本增加约五分之一,且高优先级警报必须在三十分钟内确认是否为误报,否则活动将被停止。对于一家在公开市场上与竞争对手赛跑的公司来说,这些都是代价高昂的选择,这也使得它们比贴在模型上的任何能力数字都更值得关注。向自该框架发布以来一直关注它的各位提两个问题:“无法排除达到关键层级”这一表述,应理解为真正的评估不确定性,还是为发布时给出关键评级不让人意外所做的预先铺垫?关于谁在外部验证这一评估,是否有任何公开的细节?submitted by /u/coursiv_

查看原文 ↗ 大模型发布

📌 相关阅读

GPT-6 热度 18 「GPT-6」灰测demo刷屏!周四发布在即 热度 11 Gemini 推出智能体视频理解能力 热度 10 通往 Astra 之路:关键能力与前沿安全保障 热度 10 Anthropic 新发布的 Fable 更便宜、限制更少 热度 9