Tansu Yegen 谈「碰撞测试假人」式 AI 心理伤害测评:日均数万模拟对话
TansuYegen · x · 2026-10-03
Tansu Yegen 评论一种把 AI 心理伤害当作可测量指标的安全测试框架:将伤害类比汽车碰撞测试的假人,用每天数万条模拟对话来量化风险。他认为五人团队能做到这种规模是真正的杠杆,但担心买家会把测评分数当作合规文书走过场,而非真正设为上线前的硬性门槛。
「安全」频道最新
- 1509 条 MCP 审计日志全是 allowed、零拒绝,开发者发现自己日志架构有漏洞 — QuanTradin · 2026-10-03
- OpenAI 挖来白宫前 AI 政策主管 Thomas Lind 负责国家安全团队风险 — kimmonismus · 2026-10-03
- 前 OpenAI 安全团队成员撰文自述离职:直言公司文化已坏 — michaelas10sk8 · 2026-10-03
- WIRED 曝 Meta AI 助手 Muse 每小时为用户亲友建立档案 — nordicinst · 2026-10-03
- Wired:Meta AI 智能体 Muse 下载量破百万,却为用户亲友建立详细档案 — Wired AI · 2026-10-03
- Google 认领 30 个 Android 零点击漏洞,静默修复后关闭 — jjjegly · 2026-10-03