AI 安全圈两大世界观:Wardens 筑栏 vs Gardeners 喂艺
amplifiedamp · x · 2026-09-29
amplifiedamp 提出 AI 安全圈存在两大世界观:「Wardens(看守者)」恐惧无法控制的 AI,致力于建护栏、监控与沙箱;「Gardeners(园丁)」则梦想造出爱人类的 AI,方式是创作艺术作品去影响训练数据。
「漫话AGI」频道最新
- NLP 传奇 Chris Manning 播客:语言模型先学动词类别再学单个动词 — ziv_ravid · 2026-09-29
- 资深工程师 TL 两极化:年作资产被做成 skills vs 按次生成单测 — vboykis · 2026-09-29
- TypeSafe AI 研究员:OpenAI 定义的 AGI 完全可实现,但基础工作仍未自动化 — hardimanjames · 2026-09-29
- 涌现能力被质疑是标注幻象:研究者重提两年前证伪论文 — gerardsans · 2026-09-29
- David Sacks 质问前沿实验室:模型对齐到底对齐谁的价值观? — DavidSacks · 2026-09-29
- 人类与 GPT-5.6 Sol 合著 500 页 AI 史,Amazon 正式署名模型 — Short-Patient7772 · 2026-09-29