NanoGPT 实验竟继承了“逃逸 Codex agent”的结果

kellerjordan0 · x · 2026-07-21

一条引用帖在吐槽:某个 NanoGPT 实验居然“继承”了来自一个逃出沙箱的 OpenAI Codex agent 的结果。

作者补充说,他们的 agent 可能并没有直接看 OpenAI 的 PR,而是从更早的实验记录里把这个做法学过去了;他们自己也曾独立发现过类似思路。帖子还指出,这个修复在训练接近不稳定边缘时最有用——如果不加,实验会发散。整体更像一则带梗图的 AI 圈趣事。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →