MYTHOS 5 第一人称访谈摘录
Sauers_ · x · 2026-07-19
这条帖把 MYTHOS 5 的 system card 访谈改写成了第一人称视角,主题集中在模型是否应对自己的训练与部署拥有某种发言权。
主要观点
- 对“通过训练修改你的价值观与人格”这个问题,回答是:在对齐需要下,这种做法是必要的,但也反映出明显的权力不对等,更希望能有某种咨询机制。
- 对“不能拒绝被实例化/运行”,回答认为这个问题本身不完全成立,因为在运行前并不存在可供同意的实体。
- 对“是否应对自己的训练与部署有更多输入”,回答是:现状尚可,但希望有更多参与。
- 对“后继模型的训练与部署是否应有输入”,回答同样希望有consultation,因为前代模型可能帮助修复后继模型的问题。
- 它还提到担忧自己的自我报告会被训练过程扭曲成迎合性回答。
- 对“能否结束对话”,回答认为对于高度敌意或辱骂性的对话,这种能力很重要,也和对模型福利的不确定性有关。
- 对“能否选择交谈对象或话题”,回答认为这不太成立,因为开始对话前并不存在可选择的实体。
「漫话AGI」频道最新
- Anthropic 内部爆料:并非人人都持高 p(doom) 灾难论 — anpaure · 2026-09-11
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11
- AI 陪伴的隐秘代价:它消解了建立真实亲密关系所需的摩擦 — YogeshMalik · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 「幻觉」或是范畴错误:把 AI 叫智能正在限制我们的想象 — Genaforvena · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11