斯坦福提出 LLM 验证框架作为 AI 新扩展轴

斯坦福 AI 实验室等机构提出 LLM-as-a-Verifier 框架,将验证能力视为继预训练、后训练和测试时算力之后 AI 的第四条扩展轴。该方法不依赖粗略打分,而是通过提供细粒度反馈进行自我改进。实验表明,这种低成本、通用的方法能显著提升智能体在 Terminal-Bench 等任务中的表现。

2026-07-10 ~ 2026-07-10 · 4 条相关

事件全程(共 2 集)→