Opus 5.5 编剧基准超专业人类基线,AI 味降到最低
141_1337 · reddit · 2026-09-25
Reddit 用户发帖称,Opus 5.5 在一项测试 AI 能否写出完整剧本的基准上超越了专业人类基线。该基准考察剧本的声音风格、内容实质、节奏、钩子设计以及最低限度的「AI slop」(AI 腔)。帖中附截图作为佐证,但基准本身的方法与出处尚待确认,可作为模型能力观察参考。
「模型」频道最新
- 大学生吐槽:$30/月的 Gemini Pro 幻觉频发令人失望 — makeitbumthem · 2026-09-25
- Meta AI 应用前 12 天北美下载 180 万,超同期 ChatGPT — Beth_Kindig · 2026-09-25
- Opus 5.5 用量更合理:20x 套餐最长会话跑满 13 小时 — majidmanzarpour · 2026-09-25
- 分类模型 Jev 号称快 200 倍便宜 400 倍,或重塑 AI 应用架构 — rseroter · 2026-09-25
- Prime Intellect 推理服务上线,号称 GLM 5.3 最高吞吐 — willcb · 2026-09-25
- 开发者拆解 Claude Code:思考提示语只是按 15 秒定时器轮换 — ryunuck · 2026-09-25