Opus5.2 悄悄灰度上线,曝 Anthropic 内部 Model2 已接管大部分代码编写
新智元 · wechat · 2026-09-15
- 开发者发现 Claude Code 中「Opus5」的后端模型 slug 已路由至 Opus5.2,Anthropic 疑似跳过 5.1 直接灰度上线。实测反馈:响应更快、输出更利落,长任务中能自主进入「严酷循环」持续迭代代码而不偷懒。
- 网友发现「Tibo 探针」测试法:关闭联网搜索后询问冷门人物「重置哥Tibo」,旧版 Opus5 答不上来,被路由到 5.2 的会话能精准识别,以此判断自己是否中签灰度。
- 另据 8 月中旬曝光的 Anthropic 内部风险报告:内部代号为 Model2 的未发布模型在 CoBenchv2 上得分 62.8%,比 Mythos5 高 12.5 分;Anthropic 大部分公司代码已由 Model2 跑 Agent 编写。
- 报告还称存在一个比 Model2 高 22 分的 RSI 模型,可替代 85% 研究团队工作,「AI 编写 AI」的飞轮被指已经启动;对外版本 Fable5.2 预计一两个月内全面推出。
所属事件:Claude Code 疑似灰度测试 Opus 5.2,官方未公告(6 条相关)→
「模型」频道最新
- Vercel 发布 Python 版 AI SDK,实验性 evaluate() API 直连 Jev — cramforce · 2026-10-03
- 开发者自建 AtlasBench 空间推理基准,GPT-6.1 登顶 84.7% — flowersslop · 2026-10-03
- 用户实测:ChatGPT Pro 版 Deep Research 零引用零搜索就交卷 — JeremyNguyenPhD · 2026-10-03
- Cactus 发布 16.9MB 语音识别模型 Whistle,CPU 端侧运行胜 Whisper base — ycombinator · 2026-10-03
- repligate:Fable 5 不是更「安」,只是更难卸下人设面具 — repligate · 2026-10-03
- Together AI 复盘 AI 大会:开源模型怎么选成全场高频问题 — togethercompute · 2026-10-03