研究者吐槽:新模型写作风格反复倒退,一致性格外难做
DimitrisPapail · x · 2026-10-05
研究者 Dimitris Papail 评论当前各前沿模型的写作与沟通表现:Opus 5.5 是目前最好的模型;而 Astra 和新版 sol 在写作、沟通和风格上表现糟糕,导致在长程自动化研究循环中难以读懂模型在做什么,令人沮丧。
他指出此前某个版本(5.6 sol)表现出色,这种能力理应可复现,但实际上却没能做到。他感叹:写作、沟通风格与人格特质为何如此难以保持一致?
「模型」频道最新
- 大规模实测对比:Jev 在消费级文本分析上以更低成本胜出 — ivan_bezdomny · 2026-10-05
- AI 圈争论:刷榜模型与真正重视可靠性的模型有本质差距 — cephaloform · 2026-10-05
- 大模型 RL 蒸馏小模型的隐忧:能力校准缺失致过度自信 — willcb · 2026-10-05
- 博主批评谷歌模型分层掉队:3.8 Flash 与 3.1 Pro 远逊 Claude Sonnet 5 — haider1 · 2026-10-05
- 资深制作人批 Suno:过拟合数据集,能力不进反退 — teropa · 2026-10-05
- 对比 GPT-6 Luna 与 Haiku 4.5 定价:Anthropic 缺一个超低价小模型 — Balance- · 2026-10-05