反极端主义平台用 "重定向法",引导搜索风险内容者求助
Graham_dePenros · x · 2026-08-25
Moonshot 平台采用 "重定向法"(Redirect Method)应对极端内容,而非简单审查。当用户搜索不安全或极端主义内容时,系统会通过定向广告进行拦截,并将其重定向至心理健康支持资源,甚至直接连接到去激进化专家的安全 WhatsApp 聊天。该策略特别针对容易受算法武器化影响的中年人群,秉持 "无人无可救药" 的理念。
「安全」频道最新
- Grove Research 创始人谈 Hugging Face 事故与多智能体动态 — Miles_Brundage · 2026-08-25
- WikiHow 起诉 OpenAI 擅自抓取文章训练模型 — Polymarket · 2026-08-25
- 研究揭示长文本语境可导致模型内部状态漂移并突破安全 — PresentSituation8736 · 2026-08-25
- 阿拉巴马州总检察长就 Hugging Face 黑客事件传唤 OpenAI — pstAsiatech · 2026-08-25
- Thinking Machines 推出 5 万美元安全资助,聚焦开源模型防御加速 — thinkymachines · 2026-08-25
- Bessemer 发布《The Agentic Awakening》AI 工程化实战手册 — brucemacv · 2026-08-25