网友吐槽:GPT-5.6一语中的,Opus过度工程化
richie9830 · reddit · 2026-07-31
一位网友发帖对比了不同模型处理一段 3 分钟漫谈语音输入时的表现差异,吐槽部分模型存在严重的“过度工程化”倾向。
据作者描述,GPT-5.6 仅思考 30 秒就迅速抓住了重点,精准指出了核心洞察与潜在风险,并给出了鼓励。
相比之下,Opus (fable 5) 则思考了整整 10 分钟并调用了上百次工具,最后抛出了一堆让人摸不着头脑的复杂问题,还反问用户“需要我解决这些吗”。这种小题大做的行为让作者感到十分无语。
所属事件:用户实测多款大模型,GPT-5.6 表现优于 Opus 5(4 条相关)→
「模型」频道最新
- 研究者实测:ChatGPT Ultra 长任务表现已超越 Pro 模式 — arankomatsuzaki · 2026-08-24
- 吐槽Google:Gemini 3.7发布一周仍未接入自家Jules智能体 — brandon_galang · 2026-08-24
- Qwen 27B 3.8 极低量化实测:Q3 XXS 可用 — jeremyckahn · 2026-08-24
- 用户反馈 GPT-5.6 近期输出质量显著变化 — haider1 · 2026-08-24
- Ramp 统计 Anthropic 模型使用占比:Opus 4.8 最受青睐 — vista8 · 2026-08-24
- 腾讯发布 UI-Mate-27B,支持桌面 GUI 智能体操作 — tencent · 2026-08-24