Astra 在音乐推理与几何等可验证生成任务上明显变强
latticecut · x · 2026-09-07
作者观察称 Astra 目前在这些任务上「相当不错」:音乐推理、几何等能力有了显著提升(个人体感)。在其引用的原推里,他提出一个判断框架:凡是能程序化生成并验证的东西——SVG、矢量图渲染、几何、地理推理——模型表现尚可但不算顶尖,似乎可以通过预训练解决;用 TimZ 自动生成图形效果好但美观度欠佳,这些问题理论上都能用合成数据解决。
「模型」频道最新
- 博主估算训练数据规模应为 5-7T,认为 8T 已属高估 — scaling01 · 2026-09-07
- 数学家指责 OpenAI Astra 十项数学成果涉研究不端:未引用已有文献 — asusarla · 2026-09-07
- Peter Gostev 辨析模型稀疏度爆料:Kimi 26:1、DeepSeek 32:1,1.2T 激活参数不可信 — inductionheads · 2026-09-07
- OpenAI 新模型在旧 Chat Completions 接口禁用 function tools,迁移二选一 — AI-Specialist-6597 · 2026-09-07
- 开发者实测:Astra 擅长自主目标推进,指令遵循却不及 Sol — MinqiJiang · 2026-09-07
- 美国政府正以 1 美元价格使用三大模型,合同本月到期存续未知 — LuizaJarovsky · 2026-09-07