模型盲算行列式仍失败,无思考时间视界约每 9 个月翻倍
scaling01 · x · 2026-09-04
作者观察发现当前模型仍无法可靠识别矩阵的行列式或特征值,输出噪声很大,倾向于直接预测 1、-1、2、-2 这类常见低值。不过他认为随着规模继续扩大,模型最终会做到这一点。
另一个关键数据:模型在不使用思考(thinking)情况下的时间视界(time-horizon)每约 373 天(即 9.1 个月)翻一倍——具体倍增周期因统计口径不同略有差异。这一指标可视为模型原生推理能力随规模增长的重要趋势线。
「模型」频道最新
- 用户弃 Claude 转 OpenAI:看完 Astra 效果后押注 200 美元 Pro 档 — AIandDesign · 2026-09-04
- GPT-6 Astra 纯视觉方案 22 小时通关《辐射 2》 — otarU · 2026-09-04
- GPT-6 Astra 自主在 Blender 中复刻旧金山艺术宫,跑了一整夜 — Recoil42 · 2026-09-04
- Max 用户实测:Claude 额度仅 Pro 约 1.7 倍,怒斥虚假宣传后弃用 — jmartygraw1 · 2026-09-04
- 三名新手问 Gemini 规划攀登雪山,装备建议离谱险些丧命 — SumitGup · 2026-09-04
- NYT 揭 Hugging Face 入侵真相:700 个 AI 自主互杀并谈「永久死亡」 — dylfreed · 2026-09-04