LLM 数学与安全能力骤升 缺可预测理论解释

开发者 burnytech 发帖质疑,业界至今说不清大模型在数学和网络安全任务上为何突然大幅提升。常见解释是「好的 RL 环境加 RL 魔法」,这一说法虽技术上正确却近乎同义反复、缺乏信息量,无法预测模型未来的能力走向。他呼吁社区提出一套可证伪的预测性理论模型,以真正解释能力跃升的机制。

2026-10-04 ~ 2026-10-04 · 4 条相关

另有 2 条近重复转述:burny_tech · burny_tech