GamowLabs 将推 RareBench:挑战社区分辨合成基因组与真实样本

danielmckinn0n · x · 2026-09-03

GamowLabs 团队谈临床基因组学 agent 的改进难题:真实临床数据要么对模型太简单、要么未解决且需医生大量人工验证,难以系统性优化(hill climbing),只能靠合成数据训练,但前沿模型已能识别既有工作流留下的细微模式。

他们做了一个案例测试:用 Reseq2 把合成儿童 VCF 转成测序 reads,再由一个盲测评估 agent(Codex + GPT 5.6 Sol)与真实 1000 Genomes 测序数据对比,以 96% 自报置信度正确识别出合成样本。这说明当前 LLM 已能定位合成基因组生成流程的具体改进点。

为此团队投入生成与真实难以区分的合成基因组,并将在即将发布的 RareBench 中发起公开挑战:谁能分辨哪些样本是真实的、哪些是合成的。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →