Carbon-A 开源模型注释 2.2 万物种基因组,产出 5.66 亿基因候选
yb2698 · x · 2026-10-09
Hugging Face 团队发布开源模型 Carbon-A,用于在 DNA 中发现新基因。团队用它注释了来自 2.2 万多个物种的基因组,产出约 5.66 亿个基因候选,约为 RefSeq 数据集现有基因注释数量的 16 倍,候选与模型均作为数据库开放发布。
初步湿实验验证了此前未注释的基因候选——即便在研究充分的模式生物中也存在新发现。团队指出,目前基因组的测序速度远超基因识别速度,传统方法依赖实验数据或与已研究物种的比对,导致生命之树的大部分仍属未知。他们预测 2027 年将是生物学之年:AI 实验室从数学与编码转向生物学,希望科学家能拥有不依赖少数闭源实验室政策与优先级的开放模型和资源。
所属事件:开源模型 Carbon-A 跨 2.2 万物种发现 5.66 亿基因候选(3 条相关)→
「研究」频道最新
- 科学 ML 项目的本质是循环:评测是对整个建模假设的实验 — bravo_abad · 2026-10-09
- 聊天会拒绝、上手就执行:研究揭示智能体安全评估重大缺口 — xwang_lk · 2026-10-09
- 三周刷完斯坦福AA203全部19讲:最优控制到PPO的深度复盘 — le_james94 · 2026-10-09
- 用模型规划会主动找出模型最讨喜的错误 — le_james94 · 2026-10-09
- n=12 立方体堆积纪录刷新至 2.9315,AI 方法击败前纪录 — CatAstro_Piyush · 2026-10-09
- 研究:用 LLM 当裁判评「想法新颖度」并不可靠 — MarioKrenn6240 · 2026-10-09