「Claude 设计了结合剂」言过其实:剖析智能体科学的因果归因难题
freedompreetham · x · 2026-08-21
针对 Anthropic Claude Science 蛋白质结合剂 campaign 的宣传口径,作者提出更深的科学问题:因果归因。开源系统命名只能解决组件来源问题,说不清贡献到底来自哪里——LLM 贡献了什么、Claude Science 作为 agent runtime 做了什么、人类撰写的协议编码了什么、社区已有的专业模型又提供了什么。
作者指出,一位人类研究者写了 16,000 字的实验协议,覆盖 campaign 阶段、候选工具、打分排序、验证规则、算力预算、节奏、subagent 结构与恢复行为,其中近三分之二篇幅是编排、验证与运维。Claude Science 让 campaign 得以持续运转,LLM 负责选择靶点等环节,但「Claude designed binders」这一表述承载的因果分量远超实验实际能隔离出的结论。
所属事件:Claude 科学实验遭质疑,斯坦福学者称自动编排仍是关键突破(3 条相关)→
「模型」频道最新
- 实测对比:Opus 5 效率完胜 Fable — nptacek · 2026-08-21
- Ornith 1.5 397B「The Beast」已可下载,用户准备实测 — QuixiAI · 2026-08-21
- 阿里发布 HappyShrimp 模型,Minimax 开源 Music3 — thursdai_pod · 2026-08-21
- GPT-5.6 Sol 测评:全能但或遇效用天花板 — DimitrisPapail · 2026-08-21
- ChatGPT 搜索大规模使用 site: 运算符 — Simon Willison · 2026-08-21
- 社区实测:本地运行 DeepSeek Flash 能跑多大上下文? — WesEklund · 2026-08-21