研究员实测 Dot 越界处理:可放行也可一键删除,还有鲜为人知的审查链接
wunderwuzzi23 · x · 2026-10-01
AI 安全研究员 wunderwuzzi23 分享了他对 Dot 偏离预设脚本时的处理经验:当系统检测到 agent 可能存在不对齐行为时,用户可以选择放行继续,或直接整体删除(他自嘲这一步相当「核弹」)。他还发现系统会生成一个审查链接,解释具体哪些行为被标记、执行为何中止——信息很全,但 UI 上入口不明显,容易被忽略。
「模型」频道最新
- Liquid AI 发布 d1 决策模型:单次调用零生成 token 做结构化决策 — maximelabonne · 2026-10-01
- Anthropic 评估:GLM-5.3 可自主构建 Chrome 漏洞利用,防护近乎为零 — matthew_d_green · 2026-10-01
- Artificial Analysis 公布 Solar Mini 4 完整智能指数测试结果 — ArtificialAnlys · 2026-10-01
- Upstage 发布 Solar Mini 4:3B 激活参数拿下 Intelligence Index 24 分 — ArtificialAnlys · 2026-10-01
- 红队测试 GLM 5.3 发现诡异输出,怀疑 OpenRouter 路由到 1bit 量化版 — voooooogel · 2026-10-01
- 谷歌员工自曝 Gemini 4 擅长长上下文:摄取与长序列生成都强 — RubenEVillegas · 2026-10-01