Feldar AI 自建写作基准:模型起名、开场词与句式节奏都有怪癖
almmaasoglu · x · 2026-09-06
Feldar AI 团队正在构建一个专注写作质量的 benchmark,细到观察各模型反复倾向选择的词汇、开篇用语和句子节奏。
- 已发现一些有趣的可复现模式,例如模型在命名、开场句上的固定偏好
- 团队预告后续会发布更多发现,目前只放出初步预览
「模型」频道最新
- OpenAI 达成「自动化研究实习生」目标,瞄准 2028 年 3 月全自动 AI 研究员 — soumitrashukla9 · 2026-09-07
- 博主实测 GPT 6 Astra,视频演示模型实际表现 — PurzBeats · 2026-09-07
- kimmonismus:通往递归自我改进的路径已清晰,对齐才是难题 — kimmonismus · 2026-09-07
- Qwen3.8-Max-0902 凭 1M 上下文冲上 Code Arena WebDev 榜前列 — alifcoder · 2026-09-07
- Astra 架构引内行激辩:循环深度还是时间递归更优 — burny_tech · 2026-09-07
- OpenAI 与 Anthropic 模型同爱一个名字,写作基准现命名偏好 — almmaasoglu · 2026-09-07