TypeSafe 发布 Jev:用类型化校准决策替代 RLHF 目标

ccerrato147 · x · 2026-09-20

线程结论段:出路需要不同的目标函数——不是人类偏好(RLHF),不是验证正确性(RLVR),而是校准决策:置信度追踪准确率,软件有把握时行动、没把握时升级人工。Diogo Almeida 的 TypeSafe 已于 9 月 15 日将其实现为 Jev:类型化决策、不生成文本。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →