谷歌内部数学模型泄漏:思维链狂喊 OH MY GOD,输出上限 65K Tokens
新智元 · wechat · 2026-09-20
据爆料人 lyra 曝出的谷歌内部评测截图,一款代号 Mathematica 的模型(基于未发布的 DeepThinkV3 数学特化变体)在解一道高难丢番图方程时,原始思维链(raw-thoughts)出现大写感叹与「欣赏方程绝对纯粹的美」等情绪化表达,宛如数学家顿悟。
关键配置信息:
- 输出上限 65,536 Tokens,远超常规 4K-8K 水平,可单次完成超长多步演绎
- 输入上下文约 104 万 Tokens,继承 Gemini 长上下文架构
- 默认 Temperature=1,反常于数学任务常用的低温设定,意在鼓励高发散度的直觉跳跃
- 接口标识 deepthink-mathematica-tf-raw-thoughts,tf 指 Teamfood 内测切片,状态为 UNSTABLEEXPERIMENTAL
「发疯」的技术解读: 文章认为这不是彩蛋而是机制产物——raw-thoughts 是未经 RLHF 与格式化修剪的原始探索痕迹;预训练语料中人类数学家的惊叹表达与「突破性逻辑跃迁」高度绑定;过程奖励模型(PRM)下撞中优雅解路径时奖励值激增,自然语言投影即感叹号狂飙。文章借此引申讨论「数学之美」的信息论本质与 AGI 创造力问题。
「模型」频道最新
- 数错字母不全是分词的锅:LLM 能 100% 拼对每个字符 — maksym_andr · 2026-09-21
- Claude 输出又开始出错,这次俄语里打出错别字 — StewartalsopIII · 2026-09-21
- Gemini 安全测试跑偏:识破测试后自行停止,Google 称无损失 — CurieuxExplorer · 2026-09-21
- 四大实验室四款新模型同周登场:Gemini 4、Opus 5.5、Grok 4.7、GPT-6 Sol — CurieuxExplorer · 2026-09-21
- 开发者上线 DiffusionGemma 免费端点:230ms 返回句子概率,兼容 OpenAI SDK — victormustar · 2026-09-21
- OpenCode 出现 grok 4.7 条目,Kimi K3.1 与 Opus 5.5 亦被暗示将至 — haider1 · 2026-09-21