Knuth TAOCP 全卷开放难题整理成数据集,称其为前沿模型最佳基准
sytelus · x · 2026-09-05
- 作者发布 Hugging Face 数据集 taocpopenproblems,收录 Knuth《计算机程序设计艺术》全卷中的开放难题,规模 <1K 条,含 parquet 表格,标注数学/算法/benchmark 等标签。
- 作者主张:对前沿模型而言,唯一有趣的基准将是解决开放问题的能力,因此收集高品位开放问题愈发重要,而 CS 界品位少有人能接近 Knuth。
- 数据集中部分条目已由模型求解并独立复现(如因子分解+模立方根解码出 ASCII 文本,并附验证脚本);其他条目标注为仍开放或未分类,附最新文献进展。
「模型」频道最新
- 评测者盛赞 OpenAI GPT-6-Astra:会猜到你想要什么,能力直逼 Fable — pvncher · 2026-09-05
- Meta 发布 Muse Spark 1.3:最大推理模式上线,主打「前沿性能不前沿价格」 — AIatMeta · 2026-09-05
- 用户吐槽:模型开始编造词典里根本不存在的词 — StewartalsopIII · 2026-09-05
- Alexandr Wang预告Muse Spark 1.3:推理等级可设至max — alexandr_wang · 2026-09-05
- Muse Spark 1.3 max 公开发布,编码与智能体性能显著提升 — jordihays · 2026-09-05
- Alexandr Wang 官宣 Muse Spark 1.3 max 发布,编码与智能体能力显著增强 — alexandr_wang · 2026-09-05