Rex Douglass:自动验证会把研究工作的水分剥掉
RexDouglass · x · 2026-07-27
- 作者认为,如果岗位会被 LLM 取代,这类“最糟糕的盒子”之一就是:严格部分可以被大规模自动搜索与验证覆盖。
- 对买方来说,结果更可预期;而原本占比不低的“戏剧性、铺垫和水分”会被工程化消除。
- 回复里补充说,反 LLM 焦虑常常在不同的正确性标准之间跳来跳去:一个反例可能因作者不够懂而不算数,而真正理解问题的工作又可能因为一个错误就被打成垃圾。
「研究」频道最新
- AI slop 已开始污染代码评审和科研署名体系 — rbhar90 · 2026-07-27
- ICML 2026 口头论文复现分数重算后仍偏中等 — profjamesevans · 2026-07-27
- 长周期智能体最终需要不可变事件日志 — sebpaquet · 2026-07-27
- Seed IQ 在 Doom II 里通关,引出 ARC-AGI 之后的评测问题 — Fit_Transition8824 · 2026-07-27
- 实测智能体数据科学工作流:代码能跑但常答错问题 — hugobowne · 2026-07-27
- 一份横跨 ML、系统、NLP 与音频的经典论文清单 — deliprao · 2026-07-27