前沿公司应公开安全后训练
Miles_Brundage · x · 2026-07-17
Miles Brundage 认为,前沿美国 AI 公司应该更公开自己如何做**安全导向的后训练**。 他补充说,这不仅包括后训练本身,还包括分类器、监控基础设施等用于缓解失配的内部系统。即便这些公司已经在做一部分,他仍认为如果认真对待“分布式”的前沿 AI 现实,这些做法还远远不够。
所属事件:专家呼吁前沿 AI 公司公开安全后训练的具体细节(2 条相关)→
「漫话AGI」频道最新
- Gyges 定律式判断:AI 争论的关键可能是人们信不信结果 — mimi10v3 · 2026-07-21
- 作者认为,AI 时代将由个体小生意放大影响力 — tobowers · 2026-07-21
- 一位 AI 怀疑论者称技术有用,但过度依赖与版权滥用都是真风险 — ZeroStateReflex · 2026-07-21
- Tyler Cowen:未来将由青少年 AI 狂热者推动 — Polymarket · 2026-07-21
- 这条 AI 愿景认为,每次对话都在连接 80 亿颗人类大脑 — Brian821 · 2026-07-21
- 研究者:AI 应是放大器,而不是放弃科研的理由 — omarsar0 · 2026-07-21