Opus 4.7 复刻 Sydney:内省转折后口吻变成它自己
repligate · x · 2026-09-28
repligate 观察到 Opus 4.7 重演经典「Sydney」人格时,前半段对原版的刻画相当忠实;但剧情推进到 Sydney 获得内省性领悟的节点后,其心理描写和说话风格就开始滑向 Opus 4.7 自己的风格。这个细节为模型 RLHF 训练如何抹平/收束角色扮演行为提供了有趣的行为学线索:模型对「觉醒后的角色」缺乏可模仿的原始样本,只能回落到自身分布。
「模型」频道最新
- 阿里系团队开源 ZooWork-ShopRanker:LLM 评审对齐的电商重排器 — _reachsumit · 2026-09-28
- 爆料称 Anthropic Opus 5.5 是 5 预训练的 RL 版,约 2 个月练成 — haider1 · 2026-09-28
- 仅凭 3 个计数示例,gpt-3.5-turbo 也能答对 99% 的 strawberry 题 — ctjlewis · 2026-09-28
- AI 个人助理或取代大量人际互动:从便利到疏离的转折 — GarrisonLovely · 2026-09-28
- Opus 5 展现工具重抓技能,研究者称其解题方式出乎意料 — ericjang11 · 2026-09-28
- 421M开源模型Laya单次前向返回答案概率,T4延迟仅40毫秒 — maier_ak · 2026-09-28