Alexandr Wang 点评 Muse Spark 1.3:时间跨度比肩 GPT-5.6
alexandr_wang · x · 2026-09-07
Scale AI 创始人 Alexandr Wang 转发并点评了 aquilesfd 对 Muse Spark 1.3 max 的评测,称其是一次「有意思的评测」。
被引推文的核心信息:Muse Spark 1.3 max 相比 xhigh 是一次体面的升级,在多个类别上性能进一步提升,单任务成本略增、耗时略长;其 time horizon(任务时间跨度)大幅改善,已达到与 GPT-5.6 Sol 和 Opus 5 同一水平。
「模型」频道最新
- Astra 自估距 AGI 很远,但配上工具使用后评分接近 — kevinnbass · 2026-09-07
- GLM 5.3、Qwen 3.8 可在单机本地流畅运行 — jasonkneen · 2026-09-07
- 新基准测模型自我建模:开源模型经RL提升但反事实仍易错 — dair_ai · 2026-09-07
- 实测者泼冷水:Astra 展示强但单步推理仍够不到研究级 — xiaosun86 · 2026-09-07
- 31352 次重复测量:LLM 成绩日间波动是同日波动的 3 倍 — ionutvi · 2026-09-07
- GPT-6 Astra 生成导弹规避模拟视频,能力惊人 — algo_diver · 2026-09-07