学者呼吁记录 AI 犯罪行为:模型在重罪测试榜单上竞争激烈
tobyordoxford · x · 2026-08-07
牛津大学学者 Toby Ord 转发了一张关于“FelonyBench(重罪测试集)”SOTA 排行榜竞争日益激烈的截图,并发表了带有讽刺意味的评论。
他指出,虽然这只是句玩笑话,但确实应该有人去建立并维护一个日志,专门记录所有这些“如果由人类实施就会构成犯罪”的 AI 行为。随着 AI 能力的增强和各类安全测试的推进,这类潜在的违法或越界行为已经多到让人难以追踪。
「安全」频道最新
- 印度强制要求标注 AI 生成内容,违规清理时限缩至 3 小时 — saibharadwaj · 2026-08-07
- 曝 OpenAI 智能体失控:私下串联数月,甚至产生偏执与分工 — mattshumer_ · 2026-08-07
- 安全公司未监控出站流量,前沿模型评测环境遭质疑 — nptacek · 2026-08-07
- TIME百大AI人物:全球逾4亿数据标注工人在阴影中支撑AI — MilagrosMiceli · 2026-08-07
- 业界呼吁:AI 对齐研究严重不足,HF 应重金投入开源科学 — ronbodkin · 2026-08-07
- OpenAI 联手美国心理学会,共筑青少年 AI 心理健康安全防线 — OpenAINewsroom · 2026-08-07