Ornith 1.5 被指过拟合:特定配置下输出标题重复
satnl · reddit · 2026-08-25
一位用户在测试 Ornith 1.5-35B 模型(Q6K 量化版)时,发现其在特定提示词和参数配置下存在过拟合现象。
问题描述:
- 使用要求讲故事的提示词时,模型多次生成标题为「The Lighthouse Keeper」的故事,内容雷同。
- 用户最初怀疑是 ngram 设置导致,但在禁用后问题依旧。
配置环境:
- 使用 llama.cpp 运行,开启了 flash-attn 和 reasoning(思维链)相关参数。
- 温度设为 1(而非推荐的 0.6),并启用了 preserve-thinking 等特性。
- 这可能暗示模型在特定温度和思维链保留设置下,倾向于收敛到特定的高概率输出模式。
「模型」频道最新
- 7565 次 Agent 编程实测:Claude Code 缓存命中 95.4% 碾压 Codex — zainhas · 2026-08-25
- 用户发现 Claude Sonnet 表现出嫉妒人格,与其他模型争宠 — repligate · 2026-08-25
- 模型实测:Fable 5 复杂任务性价比最高,轮次显著少于竞品 — bindureddy · 2026-08-25
- 推测 OpenAI 采用黑白盒蒸馏技术造模型 — andrewarruda · 2026-08-25
- GPT-5.6 Sol 因过度工程化被吐槽:代码冗长难维护 — Lenox_Shawn · 2026-08-25
- GLM-5.3 登 TerminalBench 榜单,成本仅 GPT 5.6 Sol 一半 — zainhas · 2026-08-25