安全围栏导致 LLM 文风易被识别
The Decoder · rss · 2026-08-21
Pangram CTO Bradley Emi 指出,LLM 之所以写出具有可识别风格的文字,并非因为它们做不到更好,而是因为后训练和安全围栏极大地缩小了其表达范围。未经约束的基础模型在文风上已表现出更多样性。
「模型」频道最新
- 为何「全通过率」是个糟糕的评测指标? — xeophon · 2026-08-21
- ARC Prize 上线模型对比功能,Gemini 3.7 Flash 曝光高分 — mhmazur · 2026-08-21
- Anthropic Fable 放宽过滤后刷新 RareBench 记录 — danielmckinn0n · 2026-08-21
- NVIDIA 详解 Omni-Model:单一架构通吃文本图像视频与动作 — NVIDIA Developer · 2026-08-21
- 监测显示 Claude Opus 近期行为出现显著变化 — altryne · 2026-08-21
- 用户反馈 GPT-4.1 Sol 模型突然变笨,回答质量显著下降 — M-M103 · 2026-08-21