用户实测:Claude Sonnet 5.0创意写作能力明显不及4.6版本
Shipposting_Duck · reddit · 2026-07-06
一名用户通过对比实测发现,Claude Sonnet 5.0在创意写作任务中明显逊色于4.6,表现为5.0倾向于为自身行为辩护而非按指令推理,并存在更严格的内容限制倾向。作者表示该下滑趋势在多个创意写作场景中均有体现,并将其与GPT-4.5之后版本质量下滑的轨迹做类比,认为一旦4.6下线,Claude创意写作能力将随之终结。
「模型」频道最新
- Claude Opus 5 被评价为强子代理,但高层创意仍偏僵硬 — iskander · 2026-07-27
- 有人称 Kimi 短期走势取决于 K3 基座模型发布 — _xjdr · 2026-07-27
- Kimi K3 在网络安全上很强,但 token 效率卡住了评测 — teortaxesTex · 2026-07-27
- 欧洲 ChatGPT Plus 用户开始看到“Extra High”质量选项 — PressPlayPlease7 · 2026-07-27
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27