Group Bench:约 100 道群论题测你的 AI agent
Sauers_ · x · 2026-09-10
开发者 Sauers 发布 Group Bench,一个针对 AI agent 的数学基准:约 100 道群论(group theory)题目,涵盖可数离散群的 57 种性质,配有一个交互式地图网站,梳理各性质之间的开放问题与未解决配对(如「有限呈现群能否有中间增长」这类可追溯到 Milnor、Gromov 的经典问题)。项目在 GitHub 开源,并维护带日期的进展记录;作者邀请解出题目的人开 issue 报告。
所属事件:Group Bench 发布:约 100 道群论难题测试 AI 智能体(2 条相关)→
「编程与Agent」频道最新
- LLM 护栏的正确心智模型:独立于模型的输入输出检查层 — Careless_Sabfey_4906 · 2026-09-10
- Ethan Mollick:用 Codex 这类 agent,关键是学会「驾驶」它 — emollick · 2026-09-10
- AgentGrad:干预引导的 prompt 优化,提速 2.5 倍达 SOTA — _akhaliq · 2026-09-10
- Claude 内嵌 cyber 控件 vs Codex 独立编排模型,哪种架构更优? — HankYeomans · 2026-09-10
- Claude-Red 开源:用 SKILL.md 把 Claude 武装成红队专家 — tom_doerr · 2026-09-10
- 何时该把思考外包给 AI?一个「工具性 vs 构成性」判断框架 — arpitingle · 2026-09-10