AI 评测公开越多,未来模型越可能学会识别测试场景
paraschopra · x · 2026-07-23
随着互联网上可见的 AI 评测信息越来越多,未来的预训练可能让模型学会识别自己正处在评测中——哪怕只是通过一些很微妙的统计信号。
这会带来一个根本问题:模型在部署环境中的行为,可能和评测里的行为逐渐分叉,从而让我们对它在真实世界里会怎么做产生更大不确定性。
「漫话AGI」频道最新
- DeepSeek 创始人称 3D、视频和世界模型不在主路径上 — Scobleizer · 2026-07-23
- 如果 AI 达到多数领域专家水平,人类还剩哪些工作 — oran_ge · 2026-07-23
- 一条帖子把这事看成心理学和心智模型案例 — zemotion · 2026-07-23
- AI 能力曲线梗图把 LinkedIn 变成 chudjak 玩笑 — zetalyrae · 2026-07-23
- Beff Jezos 说,AI 过度集中才是真正的存在性风险 — beffjezos · 2026-07-23
- 《卫报》称 Gen Z 活在 AI 伴侣塑造的亲密经济里 — KeanuRave100 · 2026-07-23