Agent RL 沙箱 CPU 利用率仅 5%,DSec 谋求逼近满载

teortaxesTex · x · 2026-09-23

网友 teortaxesTex 指出大规模 agentic RL(强化学习)的一大问题是惊人的浪费:典型沙箱环境实际只消耗约 5% 的已分配 CPU 时间。DeepSeek 开源的 3FS 生态中的 DSec 方案 aims to approach full utilization,即让 CPU 时间利用率逼近满载。作者调侃,等各路分析师注意到这一点,大概会说这对 CPU 需求是利空。并附言「big 3FS W again」。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →