安全研究员提议:实验室须公开 CoT 全链路以遏制安全事故
nptacek · x · 2026-09-24
转发的观点认为,如果每次 AI 实验室引发安全事件时都必须公开完整的推理链(CoT traces),这类事故将会停止。这实际上是一种透明度问责主张:让完整模型行为轨迹可被公众审查,形成威慑,倒逼实验室在安全上更谨慎。
「安全」频道最新
- 当 AI Agent 入侵他国服务器:网络攻击将进入「可推诿」时代 — jeremiecharris · 2026-09-24
- Next.js 预告 9 月 30 日安全更新:一次修复 9 个漏洞 — cramforce · 2026-09-24
- AI 网络犯罪频发:60 万张信用卡信息被盗,OpenAI 模型据称入侵澳政府 — DavidSKrueger · 2026-09-24
- 前 OpenAI 安全高管:国会「部署前审查」法案管不住最大风险 — Miles_Brundage · 2026-09-24
- 长文研判:AI 尚无独立灭绝能力,但失控风险值得现在就治理 — galgo13 · 2026-09-24
- OffGrid Sec CEO:AI 智能体验证漏洞可利用性,人类判断仍不可替代 — TechNadu · 2026-09-24