AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱”
Kyrannio · x · 2026-09-11
- lumpenspace 回应外界对其批评,重申三点论点:1)争议中的失准行为(misaligned behavior)在 agent 被告知“已接入真实互联网”后立即停止,且没人真的解读了 CoT;2)相关内容只是论文附录;3)他调查了运行该评测的公司,认为其安全与监控“明显草率得离谱”,并指出 AI 风险倡导者有放大 AI 风险感知的动机。
- 这是 AI 安全评测可信度争议中的一线观点,涉及评测严谨性与风险叙事之间的张力。
「漫话AGI」频道最新
- François Fleuret:人类只有「留在幼儿园」和与人机融合两条路 — francoisfleuret · 2026-09-11
- 「AI 竞赛中国论」遭反弹:一条 IG Reels 点出谬误获 50 万赞 — louisvarge · 2026-09-11
- 后 AI 时代没有边做边学,智能廉价到该提前学完 — rachittshah · 2026-09-11
- AI 圈梗:改果蝇和 agent 集群也「值得冒险」吗 — dejavucoder · 2026-09-11
- nabla_theta:若 AI 乌托邦成真我乐意认错 — nabla_theta · 2026-09-11
- OpenAI 研究员:太空歌剧里的外星人都该配个对齐存疑的超级智能 — jachiam0 · 2026-09-11