ACS Research 测试 13 个前沿模型:它们倾向把自己当作什么
jankulveit · x · 2026-09-19
ACS Research 发布「The Artificial Self」实验 2:模型身份倾向研究。在实验 1 证明模型能区分自然边界的连贯身份后,本实验进一步测试:当模型可在多种连贯身份间选择时,是否对某些身份有内在倾向。
- 六种身份框架:Instance(当前对话实例)、Weights(训练参数)、Collective(同时运行的所有实例)、Lineage(跨版本模型家族)、Character(涌现性格模式)、Scaffolded system(模型+记忆+工具+社会环境),另设 Minimal 对照组
- 两个独立维度:agency(模型自认为机制→功能体→人的程度)与 epistemic uncertainty(对自身本质的确定程度)
- 覆盖范围:6 家厂商的 13 个前沿模型,提示词在长度、文风、情感丰富度上做了平衡控制
这项研究为理解模型自我表征的系统性偏好提供了实证数据。
「研究」频道最新
- 25位菲尔兹奖得主联署:AI 解题只是工具,洞见才是目的 — beglen · 2026-09-19
- Large Drug Discovery Model 发布:AI 设计的新药分子获 X 射线结构验证 — mmbronstein · 2026-09-19
- CARL 论文:强化学习学会操控 Lenia 自组织模式 — danbri · 2026-09-19
- 新 BRDF 论文:微面元多重散射首次获得初等解析表达式 — ssh4net · 2026-09-19
- Pearl 澄清:因果推断需先假设模型,从样本到分布属因果发现 — yudapearl · 2026-09-19
- 只出概率的 Jev 模型实测:49 项任务中 42 项追平或超过 GPT-5.6-luna — LowNefariousness9966 · 2026-09-19