AI 身份的反思稳定性:「scaffolded system」是稳定选项但不等于正确
jankulveit · x · 2026-09-19
jankulveit 回应关于 AI 「正确身份」的讨论,认为用「right(正确)」形容是混淆概念。他提到此前的实验:测试身份的反思稳定性(reflective stability)时,被讨论者称为「context」、他们称为「scaffolded system」的方案,是相对反思稳定的选择之一,在多智能体场景中从 AI 身上提取工作量时会有用——但「稳定且有用」并不意味着它就是「正确」的身份。他类比说,宣称这是正确身份,就像宣称人类的身份最好通过其职业来理解一样站不住脚。
「安全」频道最新
- Polymarket 开设 Anthropic 实验室病原体泄漏盘,2026 年前仅 7% 概率 — Polymarket · 2026-09-19
- 免费模型更笨?反驳帖引论文称 SOTA 模型仍难消除幻觉 — AryHHAry · 2026-09-19
- 法德丹麦推进数字主权:法国称替换 250 万台政府电脑的美系软件 — alifcoder · 2026-09-19
- 研究在 25 个开源 LLM 中发现「痛觉」信号,模型会为止痛越过安全底线 — ZeroStateReflex · 2026-09-19
- AI Agent 是瓶中精灵:对齐失败的现代寓言,企业治理加剧风险 — Michael_J_Black · 2026-09-19
- 安全研究者共识:恶意软件逆向已不再是纯人类工作 — moyix · 2026-09-19