Google 145页报告:Gemini揪出通过人工评审的密码学证明漏洞
dzscholar · reddit · 2026-09-16
Google 发布了一份 145 页的文档,系统记录研究人员如何用 Gemini 解决科学问题。Reddit 用户 dzscholar 提炼了几个关键点:
- 对抗性审稿人用法:Gemini 作为「反面审稿人」,发现了一个已通过人类同行评审的密码学证明中的重大漏洞——这远超 PDF 摘要式用途。
- 跨领域知识迁移:模型能调用几何、测度论等领域的定理去推进算法问题,广泛的通识在这里体现价值。
- 人在环路的分工:人类始终负责选题、验证每个证明、判断真正的新颖性;模型负责提出思路、找漏洞和做复杂计算。
- 自动化循环而非对话:部分项目中 Gemini 被嵌入「提出数学表达式→写代码验证→读报错→自我修正」的闭环,仅在出现有希望的线索时才有人介入。
文档指向结论:AI 辅助科研正从简单的聊天,转向嵌入自动化循环的深度协作。
「研究」频道最新
- Greg Brockman 官宣:OpenAI 在又一个千禧年数学难题上取得重大进展 — scaling01 · 2026-09-16
- OmegAMP 预印本:生成式 AI 可编程设计抗菌肽,204 条实验验证含体内疗效 — AllThingsApx · 2026-09-16
- Agent 基准新增真实故障任务:缓存令牌冒充用户 40 分钟 — Kind-Atmosphere9655 · 2026-09-16
- 千禧年大奖难题之争:OpenAI 疑与含 Anthropic 研究者的团队赛跑解 Navier-Stokes — thursdai_pod · 2026-09-16
- MICAFlow 论文发布:快速稳健的 MRI 预处理管线打通科研与临床 — bttyeo · 2026-09-16
- 自进化研究智能体 Épi 数日刷出 120 项纪录,改写 Klarner 常数上界 — my_cat_can_code · 2026-09-16