对齐难题的另一面:我们总是高估自己判断 AI 能力的准确性
snowclipsed · x · 2026-09-28
作者提出,人类的一大缺陷是难以意识到自己可能是 AI 能力的糟糕估计者,同时又极度自负地默认「我更懂」。作者认为这一认知偏差本身也是让对齐(alignment)变难的原因之一。
「漫话AGI」频道最新
- WSJ 深挖 AI 末日论亚文化:比大众早十年痴迷末日的圈子 — sapinker · 2026-09-28
- NBER 新论文:应届毕业生失业率未见 AI 冲击迹象 — emollick · 2026-09-28
- repligate转发吐槽:造神意外造出来了,却去造会写代码的秘书 — repligate · 2026-09-28
- 学者喊话:声称造出无法控制的 AI 的实验室就该被关停 — kevinnbass · 2026-09-28
- 研究者担忧:过度依赖 Lean 形式化或将阻碍新数学发现 — LucaAmb · 2026-09-28
- 3Blue1Brown HackMIT 演讲抛问:你是牧羊犬还是哈巴狗? — AlexKontorovich · 2026-09-28