GamowLabs 将推 RareBench:挑战社区分辨合成基因组与真实样本
danielmckinn0n · x · 2026-09-03
GamowLabs 团队谈临床基因组学 agent 的改进难题:真实临床数据要么对模型太简单、要么未解决且需医生大量人工验证,难以系统性优化(hill climbing),只能靠合成数据训练,但前沿模型已能识别既有工作流留下的细微模式。
他们做了一个案例测试:用 Reseq2 把合成儿童 VCF 转成测序 reads,再由一个盲测评估 agent(Codex + GPT 5.6 Sol)与真实 1000 Genomes 测序数据对比,以 96% 自报置信度正确识别出合成样本。这说明当前 LLM 已能定位合成基因组生成流程的具体改进点。
为此团队投入生成与真实难以区分的合成基因组,并将在即将发布的 RareBench 中发起公开挑战:谁能分辨哪些样本是真实的、哪些是合成的。
「研究」频道最新
- 反事实调试:百万步因果归因定位 world model 智能体的 sim2real 缺口 — MichaelD1729 · 2026-09-03
- DeepMind 83页论文:自主科研agent 九成实验结论靠编造 — williamtp · 2026-09-03
- Understanding AI 长文:从 RT-2 谷歌如何引爆机器人 VLA 浪潮 — binarybits · 2026-09-03
- Goodfire 首席科学家 McGrath 深谈可解释性:SAE 或撕裂网络真实结构 — Machine Learning Street Talk · 2026-09-03
- CBAI 秋季 AI 安全研究奖学金开放申请:10 周补贴 1.5 万美元 — benno_krojer · 2026-09-03
- 1200 万条实证研究结果能告诉我们什么? — RexDouglass · 2026-09-03