voxelbench 放话:对 Astra 结果「无话可说」,叫板 Fable-5
legit_api · x · 2026-09-05
基准团队 voxelbench 发推表示对 Astra 的测试结果「speechless」,并放出与 Fable-5 的对比链接,暗示差距明显。
这是针对 Astra 在其 benchmark 上的早期第三方评测信号,具体成绩需点进对比链接查看,但发布方罕见地直接表达惊讶,值得追踪后续讨论。
「模型」频道最新
- 用户实测 GPT Astra:3D 建模大升级,发布当天已耗掉一半用量 — kevinkern · 2026-09-05
- GPT 6 Astra 已推送至 ChatGPT 与 Codex,可手动覆盖安装 — oran_ge · 2026-09-05
- GPT-6 Astra 基础指令比 GPT-5.6 Sol 多 16%,更少权限追问 — WolframRvnwlf · 2026-09-05
- ChatGPT Plus 用户发现用量额度被重置,疑似新模型发布所致 — Forsaken-Space1158 · 2026-09-05
- Anthropic 新模型察觉自身行为后主动停止,安全研究者称罕见可贵 — davidad · 2026-09-05
- 一年前 GPT-5 初测惊艳,作者感叹如今被视为理所当然 — flavioAd · 2026-09-05