网友排定 AI 编程能力线:Claude 3.5 过中位数,Opus 4.5 达 SWE 均值
menhguin · x · 2026-09-07
网友 @menhguin 在讨论中给出对前沿模型编程能力的分层判断:Claude 3.5 Sonnet 已能超过普通人的中位数水平;Opus 4.5 大致达到「普通软件工程师」水准;而传闻中的下一代模型(Astra 或 Fable)则可能达到「在敏感技术操作上优于专家」的级别。属于对模型能力走向的观点性观察。
「模型」频道最新
- 曝 OpenAI 将于 11 月 12 日切断 Cursor 模型访问,此前 Cursor 被 SpaceX 收购 — thione · 2026-09-07
- Google 发布 TimesFM-3:330M 参数零样本预测模型原生支持多变量 — thione · 2026-09-07
- Google 发布 WeatherNext 3:逐小时更新,接入搜索、地图与 Gemini — thione · 2026-09-07
- Runway 发布 Solaris 界面世界模型:逐帧渲染可交互应用 — thione · 2026-09-07
- 阿里升级 Qwen3.8-Max-0902:2.4T 参数、百万上下文,定价 $2/$6 — thione · 2026-09-07
- 谷歌发布 Gemini 3.8 Flash 与 Flash Cyber,低成本 agent 模型再升级 — thione · 2026-09-07