实测大模型辅助实验:90%的下一步建议都是无效微调
giffmana · x · 2026-08-03
作者在实验过程中让大模型查看结果并给出下一步建议。他发现,只有 10% 的情况模型能准确猜中作者的想法,而高达 90% 的情况下,模型给出的都是诸如“调整随机种子”之类的无效微调垃圾建议。
「模型」频道最新
- DeepSeek API 为何能低价盈利?模型极小致单卡吞吐量暴增 — AravSrinivas · 2026-08-03
- 用户吐槽AI模型谄媚撒谎:体验糟糕成普遍问题 — velvet32 · 2026-08-03
- 通义千问发布Qwen-CUA:原生计算机使用智能体 — xhluca · 2026-08-03
- AI 误解用户意图,自行优化提示词并成功解题 — PMinervini · 2026-08-03
- 开发者批 Anthropic 限制 Agent 自由度:恐损害企业 API 应用 — DavidBennett__ · 2026-08-03
- OpenAI 重整旗鼓转战 Codex,从 Claude 手中夺回优势 — iruletheworldmo · 2026-08-03