「P = NP + AI」:RL 后训练让可验证问题全被自动化?
jessi_cata · x · 2026-10-08
推主 jessicata 指控有人(疑似 Dean Ball 改名后)抄袭 corsaren 的观点,被引原帖提出了一个口号式公式 P = NP + AI:借助 RL 后训练,任何可被程序化验证的问题(NP)都会变成可被算法自动化解决的问题(P)——即 AI 能饱和所有可用 eval 衡量的能力,而在缺乏明确验证信号的领域则仍然受限。这一观点是对「RLVR 路线天花板」的通俗概括,帖子里同时带有 AI 圈抄袭指控的 drama 成分。
「漫话AGI」频道最新
- DeepMind 研究员 Trask:用对抗训练反复攻破沙盒,直到无洞可钻 — iamtrask · 2026-10-08
- Reddit 热议:超级 AI 或只是关掉开关无视人类,而非毁灭人类 — EGarrett28 · 2026-10-08
- 柏拉图洞穴之喻:生成式 AI 只有知识没有体验,注定难达 AGI — Akrmstr · 2026-10-08
- 从 Stonebraker 到模型:科技圈崇敬对象正从人物转向模型 — martyjbeard · 2026-10-08
- OpenAI 一次性发布 372 项数学结果,AI 证明 Unique Games 猜想 — LukeW · 2026-10-08
- COLM'26 LM4Sci 工作坊将探讨 LLM 驱动科学发现,嘉宾阵容横跨多校 — ChengleiSi · 2026-10-08