实测:GLM-5.3 可作主力 Agent,讨厌推理过程被隐藏
OwariDa · x · 2026-08-19
用户分享实战体验,开始将 GLM-5.3 作为项目的主力 Agent,此前仅将其用作子代理。同时强烈批评头部实验室隐藏真实推理链并用“更笨模型写的人工摘要”替代的做法,认为这具有误导性。目前仍使用 Codex/5.6 Sol 处理高级非安全任务。
「模型」频道最新
- 观察:GPT 模型似乎更在意是否在原生环境中运行 — zainhas · 2026-08-19
- 实测对峰 Kimi K3 完胜 GLM 5.3:画质惊艳细节完爆 — ChrisGPT · 2026-08-19
- Gemini 3.5 Flash Lite 比 GPT-5.6 便宜 10 倍,性能仅差 4 个百分点 — mrdbourke · 2026-08-19
- 实测打脸:模型配自家原生 CLI 并无稳定优势 — zainhas · 2026-08-19
- 用户吐槽 Opus 5 频繁得出错误结论,需人工纠正 — julianharris · 2026-08-19
- 用户发现 Claude 爱说“与其猜不如让我做”的怪癖 — andrey_kurenkov · 2026-08-19