前 OpenAI 员工:多数用户极不擅长描述需求
prajdabre · x · 2026-08-30
前 OpenAI 员工 Praj 查看了经脱敏处理的 Gemini 用户日志,发现一个核心问题:大多数用户非常不擅长描述他们想要什么。
这一观察呼应了引用推文中的抱怨:尽管随着新模型发布,编码能力不断提升,但指令遵循似乎依然不可靠。这暗示了模型能力提升与用户端 Prompt 水平之间的差距。
「模型」频道最新
- GLM-5.3-Flash 登顶 Agent Arena 榜单第四 — AccBalanced · 2026-09-01
- 智谱 GLM-5.3 Flash 推出 INT4 与 MXFP4 版本 — HaihaoShen · 2026-09-01
- 南贝格 4.2 3B 模型发布 DSpark 权重 — teortaxesTex · 2026-09-01
- Qwen 2.5 72B 本地实测:长上下文吞吐跌一半 — julianharris · 2026-09-01
- DeepSeek 等模型 SWE-bench 得分辟谣:未达 80% — teortaxesTex · 2026-09-01
- Celeris-1 Magnus 登场:称霸 τ³-bench 的 Agent 专用模型 — timshi_ai · 2026-09-01