评分者惊叹:Opus 5.5 靠「智识下注」超越所有人类表现上限
rickasaurus · x · 2026-09-23
samsinai 在批改模型表现时称起初不敢相信,甚至出门散步冷静,怀疑模型作弊,但复查后确认其做法确实聪明。最令他印象深刻的是 Opus 5.5 敢于做出智识上的冒险判断——在限时条件下可能失败——但最终赌对了,从而将性能上限压到超出所有人类的水平。这是对该模型能力的一次第一手观察。
「模型」频道最新
- Nathan Lambert 国会证词:中国开源模型下载量已达美国 2 倍 — khiladi1729 · 2026-09-23
- 砍掉解码器直取 softmax:9B 模型本地跑出 100ms 概率输出 — telltaleatheist · 2026-09-23
- 模型发布间隔从 73 天缩至 18 天,有人把 AGI 预期提前到 2027 — soumitrashukla9 · 2026-09-23
- Andriy Burkov 感叹 Codex 速度远超开源权重模型 agent,但费用高昂 — burkov · 2026-09-23
- 网传 GPT-6 可在浏览器操控 Paint 作画,演示引热议 — alexcovo_eth · 2026-09-23
- 开发者用 Opus 5.5 生成 three.js 法术与程序化音视效 demo — majidmanzarpour · 2026-09-23