开发者实测:自研决策Agent比ChatGPT/Claude每个方案省1.35万美元

KicksStandLabs · reddit · 2026-09-12

一位开发者用 10 个模拟商业项目同时测试 ChatGPT、Claude 和自己正在开发的平台 RESORSA,统一初始信息、不做针对性提示词,追踪几个关键指标:启动验证所需资金、是否质疑不必要支出、是否识别需验证的假设、是否在方向不对时建议转向等。

结果:RESORSA 推荐路径平均每个方案比另两家省约 1.35 万美元,主要来自「先验证再开发、租不买、先手动测试再自动化、用现成工具而非自建基础设施」这类朴素决策;7/10 的模拟生意按原路径走通,另外 3 个是 RESORSA 建议改方向后才成立,而其他两家模型继续推进原计划。中位 Time-to-Artifact 约 38 秒(有一个 4 分钟的离谱离群值)。

作者承认自己有利益相关、10 个模拟样本远不足以得出结论,下一步会做更多模拟并与真实创业者行为对比,表示会公布所有结果包括难看的。

原文链接 →

「创投」频道最新

更多「创投」频道 AI 资讯 →