开发者自建 Agent 框架,两条消息驱动 63 小时自主研究黎曼猜想
GuiltyBookkeeper4849 · reddit · 2026-09-14
Reddit 用户 GuiltyBookkeeper4849 开源了自研的通用 Agent 框架 Artificium,并分享了一次极端长程自主实验:
- 实验设定:仅发送两条消息(启动 + 要求最终报告后休眠),让 Agent 以攻克黎曼猜想为目标连续自主工作 63 小时。
- 资源与规模:单张 RTX 3090 上跑 4-bit 量化的 Qwen3 27B,处理超过 5000 万 input/output tokens;Agent 自主探索思路、写程序调试、构建长期记忆延续工作。
- 结果:当然没有解决 RH——作者强调重点在测试 27B 小模型能否长期自主工作而不幻觉出假解、不崩坏,并借此迭代框架。
- 框架能力:自我管理上下文与长期记忆、自制工具、修改自身目标甚至 harness;支持非阻塞多用户交互、多 Agent 实例协作、接入外部设备传感器。
- 开源:harness 在 GitHub,实验的记忆、程序、生命周期日志与指标全部发布在 Hugging Face 数据集。作者受 OpenAI Navier–Stokes 自主研究工作启发,计划用最强开源模型组建 Agent swarm 攻克千禧年大奖难题并直播公开数据。
「编程与Agent」频道最新
- 让 Codex 多线程互相审查:一位重度用户的进阶玩法 — hugobowne · 2026-09-14
- 免费 Wikipedia Trends MCP 上线,可查任意词条浏览量走势 — modelcontextprotocol · 2026-09-14
- Seekr MCP 服务器发布:整合网页搜索与内容提取 — modelcontextprotocol · 2026-09-14
- ERP 内部机器人想做到 Claude Code 级敏捷,开发者求架构建议 — Neither-Owl-1772 · 2026-09-14
- Hermes Agent 七次发布详解合集:从子智能体引导到 Omarchy 部署 — Teknium · 2026-09-14
- 开源 macOS 客户端 Locus 更新:一套 GUI 用尽 ChatGPT/Claude/Kimi 订阅与本地模型 — drankthedew · 2026-09-14