Astra 胜过 Sol 但非湿实验 SOTA,难点在生物数据未公开
nlarusstone · x · 2026-09-05
作者评价 OpenAI 新模型 Astra 在湿实验室(hard wet lab biology)任务上优于 Sol,但尚未达到 SOTA。核心原因:大多数生物推理知识并不存在于公开数据中,很难靠公开语料训练出来。作者对进展表示乐观。
「模型」频道最新
- 博主爆料:OpenAI 或已部分破解纳维-斯托克斯问题 — scaling01 · 2026-09-05
- 欧盟用户无缘 Astra fast mode,数据驻留要求成主因 — tokenbender · 2026-09-05
- 数千条 MMO 任务文案实测:LLM 局部通顺、全局崩坏,20-30 轮纠正仍无用 — HLCYSWAP · 2026-09-05
- GPT-6 Astra 现身容量报错?用户 20 小时用量从 90% 骤降到 81% — sick_burns2000 · 2026-09-05
- GPT Astra High 用 C++ 雕刻应用实测:迄今最佳 3D 空间理解 — rms80 · 2026-09-05
- Agent's Last Exam 成绩暴涨拆解:计算机使用+55 域 RL 环境 — dejavucoder · 2026-09-05