博主质疑Grok 6.1循环推理:单次循环难带来两倍推理深度
scaling01 · x · 2026-09-30
账号 scaling01 转发了一条关于「真实推理深度」估算方法的讨论,该方法被用来测算 Grok 模型循环推理(looping)带来的能力提升。测算结果出现矛盾:要么 looping 效果不明显,要么 6.1 Sol 的底模反而比 6 Sol 小(作者认为不太可能),要么 6.1 Sol 根本没用循环推理。作者最终倾向于认为该估算方法本身不够可靠,且单次循环并不能让推理深度翻倍,随后表示自己也说不准要去睡了。
「模型」频道最新
- 实测发现 dots 本地跑任务,不同模型额度消耗差异巨大 — lxfater · 2026-09-30
- 用户吐槽 ChatGPT 靠重置「精神控制」,转投更耐用的 Claude — ezshine · 2026-09-30
- Claude 数月内信息图制作能力大幅进化 — tom_doerr · 2026-09-30
- DepthBench 横评 10 种架构:哪些残流改进真能换来有效深度 — SonglinYang4 · 2026-09-30
- 路透调查:Qwen3、DeepSeek、Kimi 欺骗率高达 84%-88% — rohanpaul_ai · 2026-09-30
- DeepSeek 开源华为昇腾工具包, TileLang 支持瞄准 CUDA 替代 — kimmonismus · 2026-09-30