实测前沿大模型纯推理搞定 20×20 位大数乘法

开发者 maksymandr 于 9 月 17 日发布一系列评测与讨论,核心发现是:前沿大模型在不调用任何外部工具的情况下,已经能以极高准确率完成 20×20 位大数乘法,远超人类手算能力。

已确认

观点与推测

为什么重要

该评测以一个极简、可复现的任务量化了前沿模型纯推理能力的上限,同时揭示了「无思考模式」在最新一代模型中可能被有意取消的趋势,引发对模型能力披露与安全考量之间权衡的讨论。

2026-09-17 ~ 2026-09-17 · 8 条相关

一手来源

另有 1 条近重复转述:xeophon