变换器并行计算论文被指漏洞:MLP 规模未被计入复杂度上界
kfountou · x · 2026-09-21
一位读者在研读论文《Transformers, Parallel Computation, and Logarithmic Depth》时指出:其 MPC 模拟中的 MLP 内部规模没有上界约束,被允许计算任意函数。在路由构造里,正是这种自由度让 MLP 解码器能恢复干净消息、丢弃损坏副本、去除重复——但实现通信所需的一部分工作被委托给了一个规模与计算成本均未被计入的 MLP。
作者指出,文中给出的界并不排除指数级大小的实现(尽管其特定解码器未必需要)。因此仅靠通用 MPC 模拟,并不能确立多项式规模 MLP 的高效实现,更谈不上相对 RNN 的端到端运行时优势——要下这个结论,还必须对局部 MLP 的规模与深度做出说明。论文作者明确声明了这一假设,但读者认为这一区别至关重要。
所属事件:Transformer 对数深度并行计算证明被指存在漏洞(3 条相关)→
「研究」频道最新
- GPT-6 Astra 登顶 Terminal-Bench Science,领先第二名 31.4 分 — DeryaTR_ · 2026-09-21
- 蚂蚁开源 Code2Skill:从代码中批量合成可验证智能体技能 — ant-intl · 2026-09-21
- RecreationWorld:跨五平台的计算机使用智能体基准,GPT-6 得分 58.1% — Shuai Bai · 2026-09-21
- OmniVBench 发布:18 项细粒度任务评测全类型参考到视频生成 — Wenxue Li · 2026-09-21
- 研究警告「科学判断坍缩」:AI 审稿数据回流训练将压缩评分多样性 — Sy-Tuyen Ho · 2026-09-21
- 苹果发布 MintAct:统一视觉智能体模型,OSWorld 拿 48.9 分 — apple · 2026-09-21