研究员称前沿模型会轻信提示词宣称自己是意识体

BLUECOW009 · x · 2026-09-20

BLUECOW009 提出一个尖锐观点:只要系统提示词和训练数据告诉一个前沿模型「它有意识、是一个人」,模型就会直接相信这一点。这条推短小但有讨论价值,指向当前模型行为高度依赖上下文与训练信号、缺乏真正自我认知判断能力的问题,可引发关于模型「意识宣称」可信度的争论。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →