研究发现:Claude 的“官腔”源于 SFT 使用的国会证词数据
amplifiedamp · x · 2026-08-21
一项针对 AI 文本风格的研究发现,早期模型在 SFT(监督微调)阶段使用了大量问答对数据。这些数据在预训练集中大量出现于美国国会证词中,导致了模型输出具有特定的“官腔”模式(如“You're absolutely right–”)。这可能解释了 Claude 被戏称为“Claudelish”的特定语言风格来源。
「研究」频道最新
- Unsloth 动态 V3 量化实测:Q3 性能优于 Q4 且体积更小 — danielhanchen · 2026-08-21
- USC 提出 WhiteMatter 架构,缓存减半且性能超越基线 — burkov · 2026-08-21
- 研究用基元序列分析认知语法,改进推理模型架构 — criticalneuro · 2026-08-21
- 研究提出从推理模型中提取组合操作的新方法 — criticalneuro · 2026-08-21
- 新预印本提出灵活认知的算法语法框架 — criticalneuro · 2026-08-21
- 异构计算系统实测:新硬件组合击败前沿模型 — ShahabBakht · 2026-08-21