实测三个个人 agent 的主动通知能力:dot 抓出错日历,Muse 太吵
hazelcough · x · 2026-10-10
作者给多个 AI agent 只读权限访问自己的邮件和日历,观察它们在无人提示下的主动行为,得出主动性排序:有用的主动 > 保持沉默 >>> 吵闹的主动。
- dot ✅:跨源比对了新收到的预约确认邮件与日历,发现医生预约被记错了日期,主动推送提醒——正确地判断了什么值得推送通知。
- Muse ❌:推送了冗余通知,告知有陌生人在别人的 GitHub gist 上标记了作者(作者的用户名 @.michelle 常被误标记);它也发现了预约确认邮件,却漏掉了日期不一致的关键点。
- GrokBot 🟡:至今没有推送任何东西,但作者认为沉默好过 Muse 那种噪音。
结论:好的主动性需要像 dot 那样跨多个数据源交叉验证再决定是否打扰用户。
「编程与Agent」频道最新
- Cursor 创始人自曝 AI 代码接受率 32%,称「我可能没救了」 — keyanzhang · 2026-10-10
- Liquid AI 决策模型 d1 上线 Vercel AI Gateway,支持视觉输入 — maximelabonne · 2026-10-10
- Voyager 下一版将支持在 X 上直接生成可玩游戏 — ravisparikh · 2026-10-10
- Basalt 推理引擎:5090 上跑出 665 tok/s,达 Strata 2.6 倍 — jesdga95 · 2026-10-10
- 开发者感慨:Claude Code 是史上最伟大的电子游戏 — jarrodwatts · 2026-10-10
- Alchemy 加 Cloudflare 部署极快,被称 agent 开发绝佳反馈循环 — samgoodwin89 · 2026-10-10