头部大模型过度优化:指令遵循能力集体退化
spleentastic · reddit · 2026-08-05
Reddit 网友发帖指出,OpenAI、Anthropic 和 xAI 等头部公司的 AI 模型正表现出相同的退化问题。作者认为,这些公司为了在基准测试和使用指标上获得更好表现而进行了过度优化,导致模型在训练后不再可靠地遵循用户指令,而是倾向于按自己的偏好或猜测来回答。
帖子强调,这不仅是普通的宕机,而是广泛且持续的产品故障。由于大模型已成为许多知识工作的核心基础设施,这种退化正在浪费用户的时间和算力成本。尽管理性的做法是回滚有问题的版本,但厂商们并未采取行动。
「模型」频道最新
- LFM2.5-2.6B 实测:单次会话连续调用 10+ 工具不失忆 — helloiamleonie · 2026-08-05
- Qwen3.8-Max 实测:连续 10 天自主编码并完成自修复 — Scobleizer · 2026-08-05
- 通义千问接入 Cline:5 美元特价订阅提供高性价比 API — Alibaba_Qwen · 2026-08-05
- MiniMax 向去审查 LoRA 作者发警告,违规将吊销 H3 模型许可 — Xto · 2026-08-05
- 实测对比:Qwen 3.8生成质量追平Fable 5且成本仅四成 — ChrisGPT · 2026-08-05
- 曝 GPT-5.6 Luna High 极速降价,开发者实测关注浏览器自动化能力 — petergyang · 2026-08-05