要不要为自己的 Agent 微调专用小模型?开发者征集真实成本
Small_Luck8177 · reddit · 2026-09-06
一位开发者在 Reddit 发帖:他的 agent 在固定工具和任务上反复运行,目前用前沿模型,考虑在内部为自家 harness 做后训练(post-training),换更便宜更贴合的专用模型。
他想听两类人的经验:
- 试过的人:花了多少工程人周和 GPU 开销?harness 变化多快就需要重新训练?
- 想过但放弃的人:是机会成本太高,还是认为收益有限?
帖子本身是一个典型的「固定工具+固定任务」agent 是否值得私有化模型的讨论样本。
「编程与Agent」频道最新
- 全流程在手机上完成:Termux 里用 AI 规划、编写并打包出 APK — Digital_Otorongo · 2026-09-06
- 实测:Astra 能执行数小时长任务并迭代计划,不跑偏不偷懒 — ivan_bezdomny · 2026-09-06
- 别凭感觉选编码模型:用 A/B/C 重构实测一锤定音 — robleclerc · 2026-09-06
- 62k star 的 Orca:在 Mac Mini 上编排并行编码 agent 舰队 — kieranklaassen · 2026-09-06
- 8 个月 883 次提交造 LLM Agent 框架,作者过度工程后弃坑开源 — dancingwithlies · 2026-09-06
- 开发者用 GPT 6 Astra 一次成功改出 UEVR 双相机立体渲染 fork — pvncher · 2026-09-06