一个 demo 把 RL policy 训练和可视化搬进 tldraw

max__drake · x · 2026-07-25

有人展示了一个把 RL policy 的训练和可视化放进 tldraw,而且还能离线运行 的 demo。

帖子虽然很短,但核心思路很明确:把强化学习策略的开发、观察和调试放到一个更接近画布式协作工具的界面里,而不是传统机器学习 notebook。它既像一个研究工程原型,也像一个工具链实验。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →