实测 Jev 对比 7 个前沿模型:快 3-6 倍、成本仅 1/100,但都不懂用户偏好

PrimaryMagician · reddit · 2026-09-21

作者用「清理 110 个积压 YouTube 订阅」这一真实主观任务,对比 TypeSafe 的「决策模型」Jev 与 Opus 5、Sonnet 5、Haiku 4.5 及经 Codex 的 Sol/Astra/Terra/Luna。

速度与成本

关键发现:都不懂用户

作者随后构建了刻意朴素的方案:模型打分 + 阈值/上限规则 + 人工通过 YouTube API 逐一批准,Python + SQLite,MIT 开源(github.com/abhibansal60/tidy)。

原文链接 →

「创投」频道最新

更多「创投」频道 AI 资讯 →