观点:对齐并不比能力研究更难,多为熟悉偏差
herbiebradley · x · 2026-08-28
作者反驳了“对齐比能力研究更难”的观点,认为这主要源于研究人员的熟悉偏差。RL 或架构研究员同样能列出其领域中同等重要且模糊的难题。作者还提到,除了欺骗性对齐等长期风险外,模型被滥用的危险(如网络与生物风险)可能是近期损害的主要来源。
「漫话AGI」频道最新
- Soumith Chintala:确定任务后,定制化优于通用 — iamtrask · 2026-08-28
- OpenAI秘密测试持久化智能体,Codex化身不休眠永动机 — 新智元 · 2026-08-28
- 比尔·盖茨呼吁对 AI 和机器人征税以保护人类工作 — TheMoonMidas · 2026-08-28
- AGI 入局人类文明被比作线粒体共生 — ZeroStateReflex · 2026-08-28
- AI 安全与能力进步同步:安全故障会阻碍部署与收益 — sebkrier · 2026-08-28
- 观点:RL 训练只是推动模型长期进化的环境事件 — Sauers_ · 2026-08-28