LLM 为何突然精通数学与网络安全?缺一个可证伪的理论
burny_tech · x · 2026-10-04
burnytech 提出困惑:我们仍无法真正预测为什么 LLM 在数学和网络安全上突然大幅变强。常见的解释——「好的 RL 环境加 RL 魔法」——虽然技术上没错,但没有信息量:它既不指向未来可能性,也不说明能力上限,无法区分不同情景。他想要的是一个具体的预测模型,能回答「用这些数据、这些 RL 环境、这种架构,大概能解出多少什么难度级别的数学/网安问题」,像 Popper 欣赏的那种具有预测力和解释力、能区分不同未来状态的理论,而不是什么都能事后拟合的模糊模型。
所属事件:LLM 数学与安全能力骤升 缺可预测理论解释(4 条相关)→
「研究」频道最新
- Richard Sutton 推荐:新博士论文让机器人部署后边用边学 — RichardSSutton · 2026-10-04
- 港中文 TimePrism 中选 ICLR 2026:概率预测从采样转向场景生成 — jiqizhixin · 2026-10-04
- RL 智能体调度 LLM 群探测暗物质信号,AI for Science 新论文 — DanielWhiteson · 2026-10-04
- 研究者用引理证明玩具例解释强化学习如何让模型学会长推理链 — AndrewLampinen · 2026-10-04
- 连续学习基准:让模型自学200盘国际象棋,Elo几乎没涨 — imjustnewatai · 2026-10-04
- 《编程语言导论》第二版新增浏览器运行时与 AI 编程两章 — alfcnz · 2026-10-04