Opus 5 在多项评测中随测试时计算显著提升编码表现

dejavucoder · x · 2026-07-25

这条回复指出,Opus 5 在给到 high/xhigh effort 时,编码能力会显著提升。

发言者引用了 FrontierBench、CursorBench、ProgramBench 和 AA Coding Agent Index 等评测,认为更多 test-time compute 能让模型更充分地自检、产出更强方案,并在新任务上表现更好。

所属事件:Anthropic发布Claude Opus 5,性能达SOTA且价格减半(113 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →