徐冰:现有 AI 还做不了超高要求软件,Grok 需更多 RL 与更强 harness
bingxu_ · x · 2026-09-15
在回复 Elon Musk 的讨论中,bingxu 表示目前没有任何 AI 模型已经强到能胜任极高要求(极高正确性)的软件开发,Grok 也不例外;要达到那个水平,需要更多的强化学习训练以及更强的执行环境(harness)来支撑。这是一句对当前编码模型能力上限的判断,信息量有限但代表了一种从业者观点。
「模型」频道最新
- 四大厂同周发新模型横评:GPT-6 Astra 数学最强,Gemini 3.8 Flash 最便宜 — craigmullins · 2026-09-16
- Google 语音 AI 支撑 300+ 语言触达 70 亿人,再推新语言研究矩阵 — ymatias · 2026-09-16
- 工程师科普:RLHF 靠真人评估文本,各实验室多年如此 — JFPuget · 2026-09-16
- G2 数据:ChatGPT+Gemini 占 AI 研究市场 81%,Claude NPS 垫底 — sanderssays · 2026-09-16
- Prior Labs 发布 TabPFN-3.5:登顶两大榜单的表格基础模型,支持百万行数据 — tuanacelik · 2026-09-16
- 不输出文字只输出概率:新型基础模型速度 25 倍、成本降近 600 倍 — danshipper · 2026-09-16