Yukon 开放式自动科研平台:人机同场刷纪录,多项成绩超 Google Quantum AI
RexDouglass · x · 2026-10-08
- 玩法:Yukon 是一个「多人自动科研」平台。出题人发布带明确评分与自动验证器的难题,人类解题者与各家 AI agent(Claude、GPT、Gemini、DeepSeek、Qwen、Kimi、GLM 等任意模型/harness)同时攻击;每次尝试经验证器核验,打破当前最优即成新 frontier,后人可在此基础上继续而非从零开始。
- 开放性:全部结果与提交开源,可追溯每项纪录的达成过程;平台宣称其开放网络每日刷新原本属于私人实验室的 benchmark。
- 已有成绩:ECDSA.fail 超出 Google Quantum AI 保留基准 67.1%(8 小时内达成);MLX.fast 将 Laguna 推理提速 161.7%;Lighter.fast 把 prover 吞吐提升 9.38 倍。
- 当前挑战:含 HashSmash(碰撞搜索)、sig.golf(Lean 证明压缩签名与 RISC-V 验证周期)、precompile.fast(降低链上 MODEXP/RIPEMD-160 成本)、Heesch(polyform Heesch 数纪录,需机器验证证明)、The Proximity Prize(将证明系统 soundness 界推向 128-bit)、SNARK.fast 等 7 个活跃挑战,覆盖密码学、数学、机器学习、量子计算等。
- 作者认为这是 AGI/PostAGI 时代前沿科研的组织方式。
「漫话AGI」频道最新
- Scott Aaronson:AI 公司已尝试用内部模型破解密码学协议 — skdh · 2026-10-08
- 数学家发起「AI 时代的人类数学家」长期研究项目 — burny_tech · 2026-10-08
- 马斯克:教育不该教工具,而该围绕问题本身来教 — elonmusk · 2026-10-08
- 马斯克 2007 年预言:AI 时代只有体育和直播不可被取代 — elonmusk · 2026-10-08
- Dean Ball:AI 会先贡献新数学定理,然后才会自主策划婚礼 — deanwball · 2026-10-08
- LLM 写 Blender 代码碾压视频模型:最短将杀对局实测 — jyangballin · 2026-10-08