首次量化证实:Claude 与 GPT 用 GUI 已追平 API 能力

ysu_nlp · x · 2026-09-12

一条关于 computer-use agents(CUA)的量化评测转发:首次给出证据显示 Claude 与 GPT 系模型在 GUI 操作能力上快速进步,Fable 5.1 和 GPT-6 Astra 用 GUI 的表现已与 API 相当,「CUA 税」不复存在。其他模型仍有差距,如 Grok 4.6 API 能力强但 GUI 场景性能下降 71%。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →