随机对照试验:LLM 未显著提升新手湿实验生物操作成功率
shae_mcl · x · 2026-09-16
ActiveSiteBio 团队开展随机对照试验,检验 LLM 能否帮助新手完成湿实验室分子生物学任务:150 名普通人分别用 LLM 或仅用 Google 完成 5 项湿实验任务。结果显示 LLM 组仅 7% 的人答对至少 3/5 项,纯互联网组为 5%,端到端核心任务上无显著提升,低于专家预测。转发者感叹:湿实验实在太难了。
「研究」频道最新
- 微软新论文:免费 pause token 让模型白赚推理算力且不加上下文 — SonglinYang4 · 2026-09-16
- Geodesic 主攻对齐预训练:让安全先验扛得住能力 RL 训练 — tomekkorbak · 2026-09-16
- OpenAI 被传已解千禧年难题,网友发 2.5 万美元赌约对赌 — teortaxesTex · 2026-09-16
- 用强化学习在 Replit 上教果蝇大脑下国际象棋 — amasad · 2026-09-16
- 果蝇大脑接线 DJ 打碟?炫酷 demo 遭质疑或为造假 — TinfoilTricorn · 2026-09-16
- 自建物理实验室数据练出万亿参数模型,达内存效率SOTA — vwxyzjn · 2026-09-16