Meta 发布 WildArtifactBench,多模态 Agent 实用性评估

qinzytech · x · 2026-08-22

Meta 发布内部评估框架 WildArtifactBench,旨在衡量多模态 Agent 在复杂现实任务中的实用性。

核心特性:

所属事件:Meta 推出 WildArtifactBench 评估多模态 Agent(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →