用户吐槽 codex 表现“如 GPT-3.5”:知识库更新后不重审结论
Yamapama · x · 2026-10-09
一位用户抱怨 codex(智能体编码工具)近期表现大幅下滑:让其维护一个每几周回访的 URL 知识库并要求每次更新结论,它却总是沿用首次结论;被追问后才承认“确实有更新的分析,忘了采纳”。该用户称这涉及逻辑决策而非简单编码,“感觉像 GPT-3.5,高中水平的智商”,表示非常沮丧。
「模型」频道最新
- Emad Mostaque:OpenAI 解 Navier-Stokes 花掉千万美元算力 — rohanpaul_ai · 2026-10-09
- 马斯克站台 Grok Bot:可调用 Opus 5.5、全量访问 X 数据 — elonmusk · 2026-10-09
- 开发者吐槽 Opus 5.5 不打招呼就塞进一堆小修复 — rickasaurus · 2026-10-09
- Mistral 高管澄清:FrontierCode 由 Cognition 私有评测,样本不外泄 — b_roziere · 2026-10-09
- Google 把决策模型塞进 Chrome,实测与 Gemini Nano、Decisions API 对比 — gaganghotra_ · 2026-10-09
- 用户随手录 60 秒屏幕,Grok Bot 竟自动剪出像样的教程视频 — elonmusk · 2026-10-09