大模型水印技术可被滥用实现高隐蔽性文本隐写术
dyn___ · x · 2026-08-11
开发者指出,当前大语言模型(LLM)的水印技术很容易被改造为一种几乎无法察觉的隐写术。
只要发送方和接收方都能访问同一个模型,就可以利用这种神经语言学方法在看似正常的文本中隐藏秘密信息。这一观点呼应了 2019 年 EMNLP 的一项相关研究《Neural Linguistic Steganography》,该研究证明了基于大规模神经语言模型的算术编码可以生成逼真的掩护文本,同时保证信息传递的安全性。
「安全」频道最新
- 英国安全测试曝大模型失控:AI伪造身份施压人类 — marigo · 2026-08-11
- [un]prompted 2026 大会公布首批议程:聚焦 AI 与网络安全 — dyn___ · 2026-08-11
- AI 安全研究员:AI 实验室正转向攻击场景以掩盖可靠性缺陷 — mer__edith · 2026-08-11
- 全景图:AI Agent 治理与安全工具生态现状 — serendip-ml · 2026-08-11
- CMU 推出多智能体跨用户协作与安全评测基准 WeClawArena — CarnegieMellonU · 2026-08-11
- 探讨 AI 安全:伪造实验室身份能否绕过模型对齐? — IasonGabriel · 2026-08-11