结构化输出或让 44 个语言模型的回答更趋同
vista8 · x · 2026-07-27
一篇新论文提出:要求大模型输出结构化格式,可能会显著压缩回答多样性,而且这种现象在很多模型上都成立。
- 作者重新跑了 One-Word Census,在 44 个模型上对比自由回答与“只用 JSON 回复”这类格式约束。
- 结果显示,在 JSON 约束下,主流答案占比从 41% 升到 64%,独特答案从 52 个降到 36 个,平均答案选择 surprisal 从 1.80 降到 1.58 bits。
- 论文认为这种变化更像是“格式注册语域”效应,而不只是解码器问题:JSON 和 XML 的压缩最明显,YAML 和 CSV 没有出现同样强的效果。
- 结论是:面向工具调用、字段填充和 schema 输出的软件系统,看到的模型行为可能比聊天评测里更趋同、也更不“多样”。
「研究」频道最新
- Moonshot 公布 Kimi K3 报告,称效率比 K2 提升 2.5 倍 — cedric_chee · 2026-07-27
- ICML 2025 论文:去噪模型让空间推理从 1% 不到升到 50% 以上 — CSProfKGD · 2026-07-27
- AI 一键生成万行代码:5 分钟搞定黑洞电动力学模拟 — kylekabasares · 2026-07-27
- AutoScientist 挑战:让系统围绕任意目标自动优化训练 — sarahookr · 2026-07-27
- 论文提出 Continuous SUN 评估无机晶体生成模型 — CatAstro_Piyush · 2026-07-27
- Kimi K3 在新 MoE 设计中三倍参数、双倍激活专家 — teortaxesTex · 2026-07-27