GPT-5.6 审核数篇统计学顶刊论文,全部发现严重问题
ChrSzegedy · x · 2026-07-28
有人让 GPT-5.6 审查《Annals of Statistics》里随机抽取的几篇论文,看看是否存在严重错误。
帖子称,模型在这些论文里都找到了潜在的重要问题:
- 有些看起来还能修补
- 有些则像是更根本性的缺陷
这条帖子的潜台词是:在这类样本上,模型已经可能具备一定的一审论文审稿/审计能力。
「模型」频道最新
- 一张梗图把 AI 扩容竞赛写成 GPU 砍价 — altryne · 2026-07-28
- 传闻 Ilya Sutskever 攻克计算难题:玻尔兹曼机或迎突破 — ryangr · 2026-07-28
- 实测 GPT-5.6 Sol 电脑操作能力:轻松搞定复杂网页操作 — Angaisb_ · 2026-07-28
- 用户称 Opus 5 测了十几次,仍会把项目流程搞坏 — tomjohndesign · 2026-07-28
- 用户吐槽 GPT-5.5 总爱纠正措辞而不是直接回答 — DesireeCachette · 2026-07-28
- Opus 5 体验:技术极强但对话僵硬,更适合做智能体而非创意助手 — MicahBerkley · 2026-07-28