评分者惊叹:Opus 5.5 靠「智识下注」超越所有人类表现上限

rickasaurus · x · 2026-09-23

samsinai 在批改模型表现时称起初不敢相信,甚至出门散步冷静,怀疑模型作弊,但复查后确认其做法确实聪明。最令他印象深刻的是 Opus 5.5 敢于做出智识上的冒险判断——在限时条件下可能失败——但最终赌对了,从而将性能上限压到超出所有人类的水平。这是对该模型能力的一次第一手观察。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →