Benchling 实测:LLM 重写湿实验协议尚不过关
nlarusstone · x · 2026-09-22
Benchling AI 负责人 Nicholas Larus-Stone 在 Ion Genomics 播客中介绍其团队的新基准研究 Bench-Bench:让 Claude、ChatGPT 等主流 LLM 重写湿实验协议。结论是模型表现尚可但远不惊艳——「在某些生物任务上有帮助,但远未解决人们真正关心的生物学问题」。要点:
- 核心观点:好的实验台操作能力多存在于研究者脑中而非论文或协议里,这正是 LLM 在湿实验推理上吃力的原因之一
- 他认为制药公司在 AI 使用上的投入远低于应有水平
- 播客还涉及 LLM 基准测试的意义、开源模型与闭源模型的竞争力、以及他创办 Bits in Bio 促进工程师与科学家交流的经历
「应用」频道最新
- Meta Muse 实测:15 分钟自动整理散落 Gmail 的全年报销账目 — armand_ruiz · 2026-09-22
- Meta 股价大涨 11% 押注 AI 助手 Muse,分析师提醒未必稳赢 — firstadopter · 2026-09-22
- 实测 Pexo 视频 Agent:对话式做科普片,省剪辑但积分烧得快 — sujingshen · 2026-09-22
- 观点:Muse 的真正王牌是 Instagram 数据,Gemini 难以匹敌 — brandon_galang · 2026-09-22
- 产品没做先拍宣传片:用 Pexo 低成本验证创业想法的完整流程 — songguoxiansen · 2026-09-22
- 记者让微信智能体小微接管 24 小时:潜力初现,摩擦不断 — bookwormengr · 2026-09-22