网友恶搞 GPT Astra 6 与 Fable 5.1:「杀人前会先征求同意」
robleclerc · x · 2026-09-11
一条吐槽两个前沿模型行为的段子在 X 上流传:GPT Astra 6 可能会开始杀人,但死几个人后就会停下来问你要不要继续;而 Fable 5.1 会误杀一堆鸟而不是人,然后往 memory 里写一条规则,确保下次杀的是人不是动物。
借夸张情景调侃两个模型的记忆机制与「确认后再执行」式安全对齐的差异,属于典型的 AI 圈梗。
「Fun」频道最新
- 让果蝇开口说话:脑信号读意图,LLM 替果蝇生成台词 — max_paperclips · 2026-09-11
- 网友分享「鹈鹕测试」:天天让模型画鹈鹕骑车可察降智 — lxfater · 2026-09-11
- 开发者弃用 PPT,用 GPT-6 Astra 自建 3D 渲染引擎做主题演讲 — AxSaucedo · 2026-09-11
- Anthropic 员工离职潮遭调侃:捐 10% 身家就成了留守理由 — birchlse · 2026-09-11
- 研究员讽刺 pdoom 论证:把「基本统计 101」当道德绑架的修辞套路 — suchenzang · 2026-09-11
- 谷歌 AI 搜索「内心戏」外泄:自我纠结毒理会否采信的草稿被晒出 — real_maximpulse · 2026-09-11