GLM-5.3 摘得创意写作基准亚军,定性分析报告发布
zero0_one1 · reddit · 2026-08-22
GLM-5.3 (max) 在短篇创意写作基准测试中排名第二。该评测通过独立 LLM 评委对成对故事进行排名。新发布的定性报告对比了六个新模型与其前代在 50 对故事中的差异。分析显示 GLM-5.3 相比 5.2 Max 在叙事深度、冲突构建和情节完整性上有显著提升。
「模型」频道最新
- 调优 LLM 写新闻数月后:事实好办,文风单调难治 — ivan_bezdomny · 2026-08-22
- 2026 年端侧小模型选型:Gemma 4 与 Qwen3.5 — lmoroney · 2026-08-22
- Ox Alpha 模型实测:在 Pi Harness 中表现惊艳 — omarsar0 · 2026-08-22
- LLM 生成诡异文本,疑是合成数据中的自我对话 — ctjlewis · 2026-08-22
- Ornith 1.5 35B上线RunInfra:缓存后输入约每百万$0.02 — alejandroll10 · 2026-08-22
- 开发者质疑 Ox-alpha 模型表现,或为营销噱头 — bindureddy · 2026-08-22