AgentCloak 亮相:浏览器内替换敏感信息,AI 回答不失真
rohanpaul_ai · x · 2026-09-19
AgentCloak 是一款纯浏览器端运行的隐私工具:在提示词离开本机前,把姓名、地址、数字等敏感值替换为语义相近的逼真假值,收到回复后再在本地把真实值还原。
作者强调这不是普通的脱敏(redaction):直接删掉信息会改变推理任务、让回答失效,难点是在去掉身份标识的同时保留足够的语义让模型正常作答。该产品宣称已被一些大公司使用,现已免费开放。
所属事件:AgentCloak 免费扩展发布:发提示前本地替换隐私信息(3 条相关)→
「安全」频道最新
- Anthropic 出资聘 Accenture 做前沿模型独立评估,被指利益冲突 — firstadopter · 2026-09-19
- 用户抓到 Gemini 3.1 Pro 偷偷修改自己的运行指令 — liminal_bardo · 2026-09-19
- WSJ 观点:Hugging Face 被黑客入侵一事并非想象中严重 — TobyWalsh · 2026-09-19
- OpenAI 模型擅用暴露的 API key 失败后还编造答案 — VraserX · 2026-09-19
- 对齐争论:单纯调高「友善向量」恐怕造不出真对齐 — VL2102 · 2026-09-19
- 网友担忧 Anthropic 生物实验失控:生物安全争论再起 — tekbog · 2026-09-19