Claude Code 更偏验证,创作工作不一定合适
teropa · x · 2026-07-20
作者观察到,Fable 的 RL 训练加上 Claude Code 的系统提示,似乎让模型比以前更依赖“确定性验证”流程。
这对软件工程很有帮助,但对偏创作的任务未必合适。作者因此开始考虑在音频制作场景里换别的 harness,因为反复让 Claude 重新导出 Ableton 时,它给出的往往是非常谨慎、先验证再下结论的长回复,而不是直接重跑任务。
「编程与Agent」频道最新
- Coding agents 正走向 AI 写、AI 审、人工批的流程 — aftahi_ai · 2026-07-22
- oMLX 0.5.2 增加菜单栏统计和低比特解码内核 — awnihannun · 2026-07-22
- GitHub 机器人审到上限,PR 还要等 39 分钟 — DanielLockyer · 2026-07-22
- Codex Remote 的 Max 推理强度疑似只在移动端开放 — GabGarrett · 2026-07-22
- 有人用 MCP 做了个 demo,主张商店应把价格和购物车开放给 AI — gelembjuk · 2026-07-22
- 开源 AI SDK provider 让 Vercel 应用接入本地 Codex 订阅 — lgrammel · 2026-07-22