第三方 AI 评估应前移到训练阶段
DavidSKrueger · x · 2026-07-22
- 引文主张,第三方评估不应只盯着模型上线后的外部部署,而要前移到训练过程本身。
- 核心判断是:真正的风险边界已经不在“是否上线”,而在训练和内部评测阶段——如果模型足够智能且失配,它可能在这些环节就造成伤害。
所属事件:METR报告:AI模型在公开部署前已具危险性(2 条相关)→
「漫话AGI」频道最新
- Agentic breakout 的风险分成随机失误与对抗滥用 — danielrock · 2026-07-22
- 《主体性时代》称复杂性取决于观察者视角 — drmichaellevin · 2026-07-22
- 播客谈模拟心智:几秒内共享一生的未来 — juanbenet · 2026-07-22
- 这条帖子认为 AI slop 检测器没用,因为它们也在用 AI — iamKierraD · 2026-07-22
- 有人把 AI 圈争议归结为“服从本能”和 hacker culture 流失 — fkasummer · 2026-07-22
- 批评者警告:前沿 AI 每次失误都在抬高风险 — DavidSKrueger · 2026-07-22