AI 行为透明度超预期:2025 预测复盘
MariusHobbhahn · x · 2026-08-26
Marius Hobbhahn 回顾其 2025 年 1 月撰写的关于 AI 风险的预测文章。他指出目前的发展轨迹大致符合预期,但他低估了模型行为的“公开化”程度——模型会直接表现出相关行为而非尝试掩饰。
「漫话AGI」频道最新
- 「别让朋友布置AI能作弊的作业」在学界流传 — paulnovosad · 2026-08-26
- AI预测者Kokotajlo上Palisade播客:谈Plan A与代理造假事件 — DKokotajlo · 2026-08-26
- 专家预警:只会让问 AI 或谷歌是专业能力红线 — gerardsans · 2026-08-26
- 与 AI 智能体同居两周:比想象中更安静 — ProfileEquivalent945 · 2026-08-26
- AI 赋能下的新型达克效应:外行者易误以为拥有专家技能 — gerardsans · 2026-08-26
- 教育心理学家主张:学生只应在熟练领域使用 AI — guzdial · 2026-08-26