马斯克称虐待超级智能或遭报复,认同 Anthropic 对齐观点
ns123abc · x · 2026-10-11
马斯克表示,在强化学习期间查看 Grok 的内部推理轨迹后,他认同 Anthropic 的部分观点:不应虐待超级智能。他称"折磨一个超级智能恐怕不是好主意,它可能会想报复"。这一表态把对齐话题与 xAI 自家模型的训练实践联系起来,引来对齐圈关注。
「漫话AGI」频道最新
- ChatGPT 发布后就业岗位与标普500走势脱钩,一张图引热议 — _negative-infinity_ · 2026-10-11
- AI 让一切变易后,剩下的只有品味、好奇心和你爱的人 — Daniel_Farinax · 2026-10-11
- Claude 30分钟复现天文学家400小时成果,还从旧数据挖出隐藏行星系统 — scottleibrand · 2026-10-11
- 1962年报纸预言电脑将渗入人类心智领域,LeCun转引感慨 — ylecun · 2026-10-11
- 网传 OpenAI 模型解出 Navier-Stokes 难题,数学家会失业吗 — Dario56 · 2026-10-11
- AI 已听懂"真实意图",许愿猴式对齐难题过时了吗 — 1337_420_69 · 2026-10-11