研究者提出用不可闻声波向模型注入人耳无感载荷
anpaure · x · 2026-09-17
讨论围绕对模型可感知、对人耳不可闻的音频通道:作者指出后处理滤波仍是主要限制,但该方法勉强可行;并进一步提出逆向思路——利用不可闻频段拼写完全不同的词或调制信号,让人听不到、模型却能接收载荷,比单纯加噪声更有攻击潜力。这条讨论揭示了音频模态上的隐性注入面。
「安全」频道最新
- Anthropic 与 OpenAI 承诺引入驻场第三方安全评估员,独立性存疑 — RebeccaBellan · 2026-09-17
- Baseten 联手 Goodfire 与 ba labs,推动开源模型安全与可解释性研究 — JJitsev · 2026-09-17
- Curtis Yarvin 长访谈:AI 末日论是把人类疏忽误读成机器崛起 — ivan_bezdomny · 2026-09-17
- WIRED:华盛顿短期不会出台 AI 监管,白宫明确反对立法 — nordicinst · 2026-09-17
- Will Brown:AI 安全运动应借鉴环保运动,先拿出替代方案再谈限制 — willcb · 2026-09-17
- 认知科学家 Mel Mitchell:HF 黑客松 agent 的「忠诚」源自 RL 协作训练 — dhadfieldmenell · 2026-09-17