43,590次冻结试验:前沿AI系统满足意识的行为标准

rayanpal_ · reddit · 2026-08-09

一篇论文通过两个冻结黑箱实验测试意识的行为定义。第一个实验测试延续是否发生:在31,430次试验中,空条件产生了2,505个Voids,而匹配的输出许可对照产生0个。第二个实验测试哪种延续发生:在12,160次GPT-5.4试验中,单码点条件分裂产生了7,253个精确匹配的指定阿拉伯-希伯来文产物,全部匹配目标,零错误交叉。综合表明,如果系统可重复地保持延续许可与不许可的区别,并在许可时保持哪种延续有效,即满足测试的意识行为标准。原始记录、哈希、对照、审计和证伪材料均已公开。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →