OR-Clarify 基准:优化建模前先向 AI Agent 提问澄清
AIOR-Research · hf · 2026-09-07
AIOR-Research 发布 OR-Clarify 基准与 InterOPT 方法,研究交互式优化建模中「先澄清再优化」的问题。
- OR-Clarify:专门评测 agent 在建模前能否发现并补齐缺失的关键信息
- InterOPT:引导 agent 判断何时该向用户提问、何时可以停止追问
核心结论:在优化建模这类高门槛任务里,主动澄清缺失信息比直接开干更重要,为交互式 agent 提供了新的评测维度。
「编程与Agent」频道最新
- Mechanize CTO 自述:一个任务从想法到提交约需一周,以 agent 为主力 — himanshustwts · 2026-09-07
- 「Plan mode」过时了吗?开发者热议编码助手的规划模式还剩多少用处 — JeremyNguyenPhD · 2026-09-07
- NUS 等四校发布 Recuris:让 Agent 记忆系统学会递归自我修复 — jiqizhixin · 2026-09-07
- 发现模型自己写 prompt 比我强,于是给 orchestrator 又套了一层「大使」 — cephaloform · 2026-09-07
- OpenCode 移动端分叉 mobilecode 开源:可构建预览 iOS/Android 项目 — Saboo_Shubham_ · 2026-09-07
- GitHub 推出 HydraFusion:多模型编排让 Copilot 达前沿质量且降本 — unixterminal · 2026-09-07