Roboflow 实测 GPT-6 Astra:迄今最强视觉模型,检测领先 13.7 分
ZeYanjie · x · 2026-09-19
Roboflow 在 Vision Evals 基准上评测了 GPT-6 Astra,称其为迄今测试过的最强视觉模型。
- 目标检测:低推理档位下达 82.1% mAP@50,领先 Qwen3.8 Max 5.4 分、领先 GPT-5.6 Sol 13.7 分,且其他模型即使开高档推理也达不到该分数
- 细节理解:乐高分类案例中,能区分不同颜色/旋转/部分遮挡下的 4×1、4×2、3×2 积木,mAP@50 达 99.8%
- 其他任务:还在 box prompting、分割、重识别、机器人控制等基准外任务上做了测试,覆盖 counting 与视觉推理
- 实用建议:Astra 适合做自动标注起点,产出框常比人工标注更准,人工主要做复核
背景:OpenAI 在 Astra 发布中重点强化 computer use 能力(定位界面元素、读取文本),这些要求顺带提升了计算机视觉表现。
「模型」频道最新
- Qwen Image 2.1 明日发布,PR 已合入 ComfyUI — fruesome · 2026-09-20
- Gemini Live 与助手功能互不相通,应用集成形同虚设 — TheLionDesign · 2026-09-20
- 质疑:Jev 主打速度,为何还要经 OpenRouter 多一层延迟 — deliprao · 2026-09-20
- Claude 独立完成 RSA-896 因数分解,RSA 挑战数再破一个 — Singularitarian · 2026-09-20
- LMArena 疑现 Gemini 4 间谍模型:SVG 质量远超同门 — Background-Youth7289 · 2026-09-20
- 开源模型占 Vercel AI 网关 token 量达 78.4%,创历史新高 — Polymarket · 2026-09-20