Felda AI 自建写作基准,细至句式节奏与命名偏好
Felda AI 团队(作者 @almmaasoglu)于 9 月 7 日在 X 上连续分享其自建写作评测基准的思路与初步结果:评测不再停留在泛泛的文风打分,而是细抠模型写作的具体特征,包括命名偏好、开头用词、标点习惯,以及短句与长句在一篇文字中的交替「句子节奏」,并展示了句子节奏维度的初步图表。
已确认
- 团队已在五个模型上运行同一套句子节奏分析,对比各模型在一篇文章中混合使用长短句的程度。
- 结论是平均句长这一指标信息量有限,模型间真正的差异体现在句式节奏的多样性上。
- 一个有趣的发现:OpenAI 与 Anthropic 的模型都偏爱使用同一个名字;每张散点图覆盖 20 次输出,连线连接同一 prompt 组在不同模型间的表现,可视化展示命名偏好分布。
尚未确认
- 更完整的官方基准报告及更多发现尚未公布,作者预告后续发布。
为什么重要
- 主流写作评测多聚焦宏观文风或胜率,该基准将评测粒度下沉到标点、命名、句式节奏等可量化特征,为区分模型写作个性提供了新视角,也提示「平均句长」这类常用指标的局限性。
2026-09-07 ~ 2026-09-07 · 5 条相关
一手来源
- 五模型写作风格横评:平均句长远远不够 — almmaasoglu ·
- OpenAI 与 Anthropic 模型同爱一个名字,写作基准现命名偏好 — almmaasoglu ·
- Felda AI 自建写作基准:细到标点与长短句节奏 — almmaasoglu ·
- Felda 公开写作评测新思路:细到句子节奏与标点 — almmaasoglu · 2026-09-07
- 自建写作评测:细看各模型句式节奏与长短句交替规律 — almmaasoglu · 2026-09-07
- 【源头】Felda AI 自建写作基准:细到标点与长短句节奏 — almmaasoglu · 2026-09-07
- 【源头】五模型写作风格横评:平均句长远远不够 — almmaasoglu · 2026-09-07
- 【源头】OpenAI 与 Anthropic 模型同爱一个名字,写作基准现命名偏好 — almmaasoglu · 2026-09-07