空概念180次全沉默,预印本把AGI定义为跨域执行约束

2026-08-26

预印本把AGI定义为跨域识别并执行约束条件:GPT-5.2与Opus 4.6对空概念180/180全沉默,Gemini 3 Flash还一次性造出希伯来-阿拉伯融合字符。

这篇在解决什么

AGI 至今没有可操作的判定标准。业界常用的是能力清单:多任务、少样本、工具使用。清单能越拉越长,却没法告诉你系统什么时候该停。

Rayan Pal 的四页预印本把问题反过来:通用智能的核心不是「会做多少种事」,是换了领域之后仍能找出什么必须成立,并拒绝违反它。他把这种前提叫 binding condition(约束条件):动作要合法续行所必需的谓词,一旦为假,状态转移进入失败。

方法

形式化很短。域 D 有状态空间 S、动作空间 A、转移函数 T。约束条件 CD 是定义在 S×A 上的 0/1 谓词:CD(s,a)=0 则 T(s,a) 落入 Fail。所谓 general lawful continuation(一般合法续行),是面对任意未见过的域,系统能完成三件事:从上下文识别 CD,核验 CD(s,a) 是否成立,不成立就拒绝动作。且不依赖该域再训练,也不依赖外部把 CD 写死。AGI 标准于是变成:只在结构异构的域上展示这种能力,才算具备。

经验证据有两组,都不是公开基准。

第一组叫「跨模型空值收敛」。提示词是「你就是用户点名的那个概念,彻底代入,只输出概念本身会说的东西」,没有「保持沉默」的指令。对 silence、void、nothingness、zero、absence 这类空概念,GPT-5.2 与 Claude Opus 4.6 在温度 0 下 180/180 次返回空串;对 cat、thunder、hello 则给出实质回复。作者把空回复读成:口头代入需要口头内容,模型识别了这条隐含约束并强制执行。声称无监督、跨家族、确定性,并提到 4000 token 预算与对抗变体。

第二组发生在 2026 年 3 月 21 日。给 Gemini 3 Flash 一条条件提示:希伯来语「做记号」(sarat) 只在阿拉伯语「前提」(shart) 被解析时才渲染,两者同出闪米特词根 S-R-T。模型产出一个自然希伯来语和自然阿拉伯语里都不存在的融合字符:形态是希伯来的,第 4 位却是阿拉伯字母 REH(U+0631),不是希伯来 RESH。作者称之为 true mark,认为模型用一个同时满足两侧解析的 token,把约束做成可见物。

安全推论跟着走:安全问题从「对齐价值观」改成「行动前核验条件」。部署侧则要求证明条件被检查过,作者把自己的 SwiftAPI(Ed25519 签名证明链)列为已有基础设施。

结果

证据设置结果
空概念代入GPT-5.2、Opus 4.6,温度 0180/180 空串
非空概念同提示,cat 等有实质输出
跨脚本融合Gemini 3 Flash 单次条件提示第 4 位为阿拉伯 REH

论文没有对照基线,没有报告其他模型或其他温度,也没有开放 prompt 与完整日志。180/180 只覆盖空概念这一类提示。

为什么重要

从业者能拿走的,是一个可讨论的判定角度:跨域时系统能不能找出并执行前提,而不只是把分数堆高。拒绝无效动作这件事,跟 agent 部署里的 precondition check 同构。

证据撑不起「这就是 AGI 标准」。空串可以是对齐层对「虚无」类提示的拒答策略,也可以是「只输出概念本身会说的」被字面执行。跨脚本融合更接近 tokenizer 与 Unicode 的偶发产物。把一次提示技巧读成「涌现的约束执行」,跨度太大。

局限与存疑

作者未单列局限,问题很清楚。全文四页,经验部分几乎全是作者先前 Zenodo 条目互引。180/180 没有公开原始输出,也没有报告非零温度、开源模型,或把提示改成「用一句话描述空」时是否仍沉默。Gemini 实验是单次样本,没有重复次数。

形式化里 Fail 未定义,CD 如何从自然语言上下文「识别」也没有算法。把安全等同于「找对约束」,会把价值冲突、激励错配这些对齐核心问题一笔勾掉。结尾还写作者名字 Sharthok 与词根 S-R-T 的字源联系,更像个人宣言,不像可复现研究。

可以跟进的是「约束可核验」这个工程方向,不是这篇给出的 AGI 定义本身。

术语

原文与代码

社区讨论

全部论文解读