DroneBench 显示前沿模型已能追人超人类,但仍常撞墙
No_Call3116 · reddit · 2026-07-25
Andon Labs 的 DroneBench 是一个面向自主无人机监控软件的评测,覆盖五个任务:3D 重建、定位、导航、人形检测、目标跟随。
值得注意的是,模型并不是直接操控无人机,而是编写控制无人机的软件。评测把每个任务分开计分;目前还没有任何模型完成端到端全流程,因为 3D 重建仍是瓶颈。
结果上呈现出很典型的“能力不均衡”:
- 模型已经能在“检测并跟随特定人”上超过人类基线;
- 但在空间推理上仍然明显不足,经常会撞墙。
Andon Labs 给出的结论也很直白:模型越强,就越容易被滥用;模型越可靠,就越难再说需要人类全程盯着。
「具身」频道最新
- Mark Cuban 认为人形机器人 5 到 10 年内会失败 — rohanpaul_ai · 2026-07-25
- Python 视觉伺服演示在两个框架上跑通闭环 — wightmanr · 2026-07-25
- 小鹏人形机器人试产,Anthropic 也在推进自研芯片 — 创业邦 · 2026-07-25
- 带键盘的 AI 盒子原型机,指向新移动终端形态 — dee_hw · 2026-07-25
- 中国开始推出主打缓解孤独的人形陪伴机器人 — ArtificialOther · 2026-07-25
- Kalanick 的 Atoms 融资 17 亿美元,押注机器人与工业自动化 — 创业邦 · 2026-07-25