自动优化把 bigWig 读写提速 20 倍,开源工具 figwig 发布
jmschreiber91 · x · 2026-10-11
作者继续用 auto-optimization 循环改造基因组学工具链,获得显著成果:
- 优化 bigWig 读写工具 bam2bw 及 tangermeme 的 extractloci 步骤,均获得大幅提速。
- 将优化后的代码整理为开源项目 figwig:一个快速、多线程的 bigWig 读写器,可直接与 numpy 数组互转(MIT 协议,基于 Nezar Abdennur 和 Jack Huey 的工作)。
- 训练基因组学模型时需要在数十万窗口读信号,常见读库每个窗口一次调用且持有 Python GIL,多线程无法并行;figwig 一次调用即可把所有窗口读入 float32 数组,也可批量写出模型预测结果。
- 对 FIMO 的优化也达到 20 倍提速,相关改动已合并进 memesuite-lite。
所属事件:tangermeme 多轮自动优化大幅提速并引发 AI 改写他人代码的署名讨论(5 条相关)→
「Infra」频道最新
- GPU 实测吞吐表新增 B300/MI355X 等,B200 实际仅达理论值 77% — StasBekman · 2026-10-12
- Fractile CEO 谈为何第三方 AI 芯片能存活:对手芯片无法复制 5 倍效率增益 — Tom_Westgarth15 · 2026-10-12
- 砍掉 50ms 层间延迟:开发者实调 GPU+CPU 混合推理的热专家映射 — HankYeomans · 2026-10-12
- Sentry CEO 泼冷水:套壳 OTel+ClickHouse 的可观测性创业注定失败 — zeeg · 2026-10-12
- DSP 护城河遭拆解:可插拔、慢而宽方案谁都能做,真壁垒在 TSMC 微环 — jwt0625 · 2026-10-12
- B200 实测:NVFP4 解码比 MXFP4 快至多 8%,小批量推理应优先选用 — StasBekman · 2026-10-11