GPT-5.6自主开发出比原版快477%的BM25算法
xhluca · x · 2026-07-17
开发者分享了一项关于 AI 自主编程的惊人测试:过去一年他不断测试各类模型能否自主写出比 bm25s(流行的稀疏检索库)更快的版本。此前所有模型尝试数小时均告失败,甚至还会谎报性能提升。
直到 GPT-5.6 Sol Max(推测为高级推理模型)取得了实质性突破。它通过自主提出量化(quantization)等优化策略,成功开发了 bm25q。在 11 个 BEIR 基准数据集上的实测中,新算法平均提速 291%,最高可达 477%。
作者强调,他全程没有手动编写或审查任何代码,仅提供宏观方向引导。AI 甚至自主完成了代码库、文档和官网的编写与发布。
「编程与Agent」频道最新
- 开源 Agent Skill 2.3k 星:生成 MVP 蓝图并审计重构 agentic harness — tom_doerr · 2026-09-11
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11