多前沿模型在『校园』框架下收敛出同一架构蓝图,GPT-5.6 与 GPT-6 蓝图高度重叠
Afshin Khadangi · hf · 2026-09-16
作者 Afshin Khadangi 对 OpenAI、Anthropic、xAI、Google DeepMind 的六类前沿模型做了实验:每个模型类型跑 10 个独立会话,用三阶段提示(从架构偏好到完整 ASCII 骨架图),并以『面向学校听众』作为框架。
核心发现:
- 在校园听众框架下,各模型反复收敛到一套共享架构模式:持久潜在状态、自适应计算、记忆、专家路由、验证、停止控制、延迟解码
- 移除校园框架的对照实验中,回答明显异质化,无法复现同样的稳定模式收敛——框架设定是该效应的关键条件
- 最引人注目的观察:GPT-5.6 Sol 产出的『后继架构』与 GPT-6 Astra 独立勾画的架构高度重叠
遗留问题: 论文提出『epistemic jailbreak』概念——随着要求的具体度上升,技术溯源纪律随之丧失。作者强调实验只建立可重复的行为模式,不验证任何私有实现宣称,并把问题留给社区:这些模型是在独立想象同一架构未来,还是设计母题在模型家族间有某种传播?
「模型」频道最新
- LLM 生成评分标准会被钻空子:新基准 ImpossibleRubrics 揭示 — Bowen Qin · 2026-09-16
- DeepSeek 不断上移二次方分量,被赞是「苦涩教训」式科学探索 — teortaxesTex · 2026-09-16
- 品牌想进 AI 回答?参数记忆与检索落地缺一不可 — dejanseo · 2026-09-16
- 用户吐槽 Claude 20 美元套餐额度骤降,十几条消息即触顶 — koltregaskes · 2026-09-16
- AI 一周:世界模型逼近物理世界,Devin 双模型协作反降 9% 成本 — TheTuringPost · 2026-09-16
- DeepSeek V4.1 Flash 被指遭评测社区冷落,ARC-AGI 与数学竞技场均缺席 — teortaxesTex · 2026-09-16