可解释性研究者转发神吐槽:EA 到底哪次说错了?

NeelNanda5 · x · 2026-10-05

Neel Nanda 转发了 Laneless 的反讽吐槽:除了疫情、加密货币、scaling laws、power seeking、工具性收敛、CoT 可监控性、机制可解释性、RLHF、谄媚、RL 诱导的 reward hacking、涌现性失调,以及让一小批 OpenAI 出走员工反超老东家的底层洞察之外——EA 到底哪次说对过?

这条反讽式长列举浓缩了 effective altruism / AI safety 社区近年的主要议题战绩,在 AI 安全圈引发共鸣。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →