Lasso 发现 AI 文本水印会改变模型与 Agent 行为
CackleRooster · reddit · 2026-09-22
Lasso Security 指出,LLM 文本水印本用于判断文本是否由机器生成,但带水印的模型行为也会随之改变,影响其作为 Agent 的表现。这意味着水印不是无副作用的标记手段,可能在下游应用中引入意料之外的行为差异。
「模型」频道最新
- 曝 OpenAI 训练 24 天的新模型已解决百余个数学开放难题 — IgorCarron · 2026-09-22
- Paradigm 发布 Limite 1B,专攻高频数学推理的 1B 小模型 — tensorqt · 2026-09-22
- 推主推测 Grok Pro 线为 Flash 线延伸,mxfp4 QAT 服务 RL rollout — stochasticchasm · 2026-09-22
- 从 Adam 转向 Muon 中期训练?业界热议预训练优化器切换与 mxfp4 QAT — stochasticchasm · 2026-09-22
- 扩散 LM 快 5-10 倍却没火,Jev 赶上 agent 变强但慢的时机 — eliza_luth · 2026-09-22
- GPT-6 调推理强度不再失效提示缓存,Codex 支持中途自适应推理 — daniel_mac8 · 2026-09-22