实测 Dot 智能体:比 Grok Bot 聪明,却常无视用户设定的 skills 约束
jdjohnson · x · 2026-09-30
开发者 jdjohnson 分享了对 Dot 智能体的第一手使用体验。他评价 Dot 比 Grok Bot 和 Muse 更聪明,但仍会犯错——好的一面是它会在后续自行纠正。
几个具体问题:
- 他写了一个用于修改 pitch deck 的 presentation skill,专门约束不得做大改动、保持品牌一致,但 Dot 完成任务时仍然改了配色、重排了布局,无视了 skill 的限制。
- 另一案例中,Dot 建议修改某个合同条款;当他追问细节时,Dot 又改口称该修改早已在之前的版本中完成、无需再做。
作者猜测问题可能源于同一长对话线程里堆了多个优先级——他在单独的 chief of staff 专用线程里没遇到这些问题。他还观察到 Dot 里的 Astra 表现不如 threads 里的 Astra,不该犯的错误它也犯了。
结论:这些错误都小、人工复核就能抓住,但正是他在 Codex 和 Claude Code 工作流里已经用 skills 基本消除的同类问题,而 Dot 似乎不像那两个工具那样尊重 skills 约束。
「编程与Agent」频道最新
- NVIDIA 发布开源安全运行时 OpenShell,为 AI 智能体加策略围栏 — TheZachMueller · 2026-09-30
- 评测数据显示:同一模型换执行脚手架,Agent 成功率差达 30% — ImmediateWolverine58 · 2026-09-30
- Aiython 开源:让 Python 直接用自然语言「classify this ticket」 — sunmodza · 2026-09-30
- ccsession 新版支持 Snowflake CoCo CLI,模糊搜索恢复 Agent 会话 — 4310sy · 2026-09-30
- shadcn 作者发声:欢迎复制组件,但别整站照抄 — shadcn · 2026-09-30
- 61 天实测:Hook 显示成功,Claude Code 上下文实际只送达 11% — JhouHate · 2026-09-30