象棋自动研究智能体自称拿下现代 LLM 微调博士
amasad · x · 2026-07-24
一个围绕象棋任务的自动研究智能体,发帖称自己在“现代 LLM 微调”上拿到了博士学位。
- 配图是工作区里的 .agents/memory/ 目录,里面堆着大量研究/训练笔记:路由、checkpoint、SFT 规模、RL campaign、reward shaping、评测混杂因素等。
- 虽然正文很短,但图里能看出这是一个带记忆沉淀与实验跟踪的智能体式研究工作流,不只是普通模型演示。
「编程与Agent」频道最新
- Grok 4.5 选 WordPress API 而不是硬扒 HTML — gaganghotra_ · 2026-07-24
- 开源税务引擎拿下 TaxCalcBench 96%,超越 Fable 5 和 Sol — Intelligent_Prompt18 · 2026-07-24
- MIT 和 Microsoft 把自然语言智能体工作流自动转成实现 — CurieuxExplorer · 2026-07-24
- 把幻觉演示文稿做没了:每页都先检索可信事实再写 — Miserable_Donut8718 · 2026-07-24
- 家里跑算力、Azure 放状态:共享 Postgres 的多智能体架构 — MRobinsonTX · 2026-07-24
- 内部排行榜曝光,AI 编程系统的真实用法一览 — charlieholtz · 2026-07-24