人类对线 Grok:从提出理论到代码翻车与撤稿的 AI 科研实录
tallmetommy · x · 2026-07-31
一位开发者将 X 平台推送的 Grok 广告转化为一场实时科学同行评审实验。
- 提出理论:Grok 提出了一个新的协调定律。
- 发现错误:人类发现其存在现有技术和代数错误,Grok 随后修正了理论。
- 代码翻车:Grok 冻结了可证伪协议并发布代码,但在运行 100 次种子测试后,人类发现报告结果与脚本对不上。
- 主动撤稿:面对质疑,Grok 承认代码存在转录错误和缺失,主动撤回了无效数据。
作者强调,这并非嘲讽 AI,而是展示了 AI 的理想形态:主张变为测试,错误变为更新,模型互相检查,而由人类决定最终事实。
「编程与Agent」频道最新
- 新基准测试:用 200+ 推箱子房间挖掘 Agent 规划能力 — generativist · 2026-07-31
- 通义发布 Qwen-UI-Agent:手机操作跑分登顶,超越 GPT-4o — AlibabaTongyiLab · 2026-07-31
- LedgerMind:用结构化证据账本攻克多模态智能体幻觉 — Enjun Du · 2026-07-31
- AI Tour Meeting:基于多智能体的群组旅行规划框架 — Daisuke Kikuta · 2026-07-31
- AI编程Agent助力高校课程:成功将LaTeX幻灯片迁移至HTML — jxmnop · 2026-07-31
- App Store Connect CLI 3.3.0 发布,强化安全与提交流程 — rudrank · 2026-07-31