阿里 Qwen 无人值守自主编程 10 天:能提 Issue 也能自修 Bug
Due-Cup9574 · reddit · 2026-08-04
一名开发者分享了使用阿里 Qwen 模型进行自主编程的测试结果。在给定一个空代码仓库且完全无人干预的情况下,Qwen 展现了较强的长周期自主性:它能够自行提交 Issue、编写代码、运行测试,并修复失败的测试用例最终完成合并,整个全流程耗时超过 10 天。
作者指出,尽管这证明了 Agent 具备长时间自我纠错和持续工作的能力,但它并非完全完美,期间仍需要几轮人工反馈才能彻底做对。这种能连续运转数天的循环工具,与传统的单次提示对话有着本质区别。
「编程与Agent」频道最新
- Next.js 16.3 发布:内存占用大降 90%,强化 AI Agent 工具链 — Vjeux · 2026-08-04
- 开发者分享AI Agent架构演进总结图 — bingxu_ · 2026-08-04
- ChatGPT 频繁破坏代码库,开发者抱怨模型能力倒退 — wowa93 · 2026-08-04
- 利用浏览器开发者工具快速将任意网站转为 API 或 MCP 服务 — dsp_ · 2026-08-04
- Anthropic 工程师演示多智能体循环:40 分钟从零构建完整应用 — mathemagie · 2026-08-04
- 生产环境跑 Agent 一年复盘:可控审计比模型能力更重要 — KimLikeJ · 2026-08-04