研究者称 Claude 已从频繁犯错变成多数时候帮上忙

matthew_d_green · x · 2026-07-29

这位研究者还用自己的真实使用体验说明了模型进步:今年 2 月前后,他几乎每次和 Claude 对话都要反复纠错;而到了昨天,情况已经明显反过来,工具大约 4 次帮忙、1 次出错。

这类对比不算基准测试,但很直观地说明:在高要求的专业任务里,模型的可用性正在快速提升。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →