曝 Anthropic 内部模型能力显著提升,可替代部分技术员
imjustnewatai · x · 2026-08-15
据 Anthropic 186 页风险报告披露,该公司内部存在一个名为“Model 2”的系统,其能力显著优于 Mythos 5。在内部代码和基础设施诊断任务中,Model 2 得分 62.8%,而 Mythos 5 为 50.3%。Anthropic 估算约 85% 的得分意味着模型可完全替代技术员并可能导致递归自我改进。目前 Model 2 和 Mythos 5 已作为持久研究代理运行,Claude 撰写了生产环境中的大部分合并代码,虽将研发速度提升了不到 2 倍,但已显著加速。
所属事件:Anthropic 曝内部模型 Model 2 超 Mythos 5,暂无发布计划(12 条相关)→
「编程与Agent」频道最新
- 争议:真正的 LLM 工程师不只是调优提示词 — bgoncalves · 2026-08-15
- ComfyUI 0.33破坏H3 Motion Context,作者发布修复并解析上游变化 — Sad_Berry_4621 · 2026-08-15
- Amp Orbs沙箱实测:安全隔离环境提升Agent开发体验 — HamelHusain · 2026-08-15
- DeepSeek 开源 Agent 框架 Harness:一切皆插件 — 大模型之路 · 2026-08-15
- 文档理解库 deepdoctection 更新 1.0 版,支持 PyTorch — tom_doerr · 2026-08-15
- Polygres 将 Postgres 变为 Agent 扩展上下文 — Scobleizer · 2026-08-15