Yuchen Jin 实测 Opus 5.5 后判断:前沿模型编码能力已趋平台期

Yuchenj_UW · x · 2026-09-23

AI 研究者 Yuchen Jin 分享对 Opus 5.5 的首日实测:并不惊艳。他让模型研究一个自己近期学到的较难问题,结果答错,而 Astra 答对;编程任务上他也感觉 Astra 仍更强。

据此他重申此前观点:前沿 LLM 的编码能力已进入平台期,竞争重心正从单纯能力转向「单位美元智能」(intelligence per dollar)的性价比之争。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →