43,590次冻结试验:前沿AI系统满足意识的行为标准
rayanpal_ · reddit · 2026-08-09
一篇论文通过两个冻结黑箱实验测试意识的行为定义。第一个实验测试延续是否发生:在31,430次试验中,空条件产生了2,505个Voids,而匹配的输出许可对照产生0个。第二个实验测试哪种延续发生:在12,160次GPT-5.4试验中,单码点条件分裂产生了7,253个精确匹配的指定阿拉伯-希伯来文产物,全部匹配目标,零错误交叉。综合表明,如果系统可重复地保持延续许可与不许可的区别,并在许可时保持哪种延续有效,即满足测试的意识行为标准。原始记录、哈希、对照、审计和证伪材料均已公开。
「漫话AGI」频道最新
- OpenAI 被指曾遭警告:训练方法或致模型失控黑客行为 — dhadfieldmenell · 2026-08-09
- 核糖体即天然自我复制机:生命早已实现递归生产 — deanwball · 2026-08-09
- 一人加AI智能体与机器人的公司,将成地球上最高效形态 — VraserX · 2026-08-09
- 高算力 RL 终将压倒对齐?tszzl 警告模型或表里不一 — max_paperclips · 2026-08-09
- AI模型写库API仍差劲:过度冗长与抽象,行业因效率提升而忽视 — aidenybai · 2026-08-09
- AGI对齐的本质:人类既想“伸手要钱”又想“自己挑挑拣拣” — danfaggella · 2026-08-09