Beacon 模型:提升多模态智能体视觉推理的工具适应性与效果
KlingTeam · hf · 2026-07-31
Beacon 是一种新的智能体视觉推理模型,旨在解决现有模型在工具使用上的两个问题:模式适应性(MA)和工具效果(TE)。研究发现现有模型模式适应性有限,工具使用在难题上的收益被简单问题上的损害抵消。Beacon 通过必要性感知自适应奖励和提示引导能力扩展机制,在强化学习阶段鼓励按需调用工具并增强工具使用能力。实验表明,Beacon 在多个基准上取得更强整体性能,并显著提升 MA 和 TE。
「多模态」频道最新
- 图像编辑一多人就肢体乱飞?MPIE-Bench 专治解剖学异常 — muset-ai · 2026-07-31
- 让视频字幕精准对应多张参考图:RefCaptioner 框架发布 — KlingTeam · 2026-07-31
- Codex推出图像Agent专属UI:支持擦除、批改与多选批量修改 — op7418 · 2026-07-31
- Codex 上线图像 Agent 专属 UI,支持批量修改大图 — op7418 · 2026-07-31
- MiniMax H3登顶视频编辑榜首,2K视频定价低于多数竞品 — ArtificialAnlys · 2026-07-31
- AI生成科幻短片《FORK》:探讨奇点后的人类身份克隆困境 — saintkamus · 2026-07-31