实测对比:Astra 越野语义理解远胜 SAM3,识别球员角色 42/45
TheMoonMidas · x · 2026-09-11
博主 AlexBodner 用足球比赛画面实测 SAM3 与新模型 Astra 的图像理解能力,结论是在简单名词类任务上两者接近,但复杂语义场景差距明显:
- 找 "referee"(裁判):SAM3 得 16/20,Astra 满分 20/20。
- 查询 "参与这次进攻的球员":SAM3 返回画面里所有球员,而 Astra 准确挑出 16 人中的 4 人,并标注各自角色(持球、传球选择、上抢)。
- 查询 "脚下有球的球员":SAM3 返回全部 18 人,Astra 精准返回目标,成绩 42/45。
- 查询 "10 号球员":SAM3 无法识别,Astra 能读懂球衣号码。
作者认为 Astra 对图像上下文的理解能力非常突出,计划基于它构建更多应用。
「模型」频道最新
- DeepSeek V4 训练细节曝光:RL 训练超 10T token,上下文冲到 1M — stochasticchasm · 2026-09-11
- 曝 DeepSeek V4.1 Flash 配 196B 参数查询表 Engram,查表代替计算 — cephaloform · 2026-09-11
- 观察:v4 训练无失稳,1M 上下文撑约 10T token 训练量 — stochasticchasm · 2026-09-11
- Neel Nanda 复现 Astra 系统卡:无思维链推理能力暴涨 1.75 倍 — NeelNanda5 · 2026-09-11
- Artificial Analysis 没被收买:自费 1.3 万美元实测各家模型 — Antblue · 2026-09-11
- 调惯 Claude 检查点的老玩家:回用 Opus 3 才算「回魂」 — repligate · 2026-09-11