OpenAI「数学突破」遭质疑:真功夫在提示工程而非模型

gerardsans · x · 2026-08-21

gerardsans 对 OpenAI 最新宣传的 LLM「数学突破」提出质疑:99% 的魔法其实来自提示工程——通过精心锁定搜索空间,把正确的解题路径预先烘焙进上下文,人类在前期完成了真正的智力工作。

他指出 OpenAI 可能在单个特定 prompt 上迭代了数月,但不会公开这一点;拿原始 ChatGPT 让你自己解,大概率到不了同样的结果。此外候选解仍需人工逐一校验,所谓突破并非模型独立解决数学问题。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →