论文破解 Claude 与 GPT 隐藏推理过程
Zealousideal_Sort74 · reddit · 2026-08-12
近日一篇论文展示了如何从闭源大模型 API 中「窃取」100% 的推理 token。作者基于此分享了几个关键洞察:
- 评测水分:泄露的推理过程显示,Claude 在面对 AIME 等基准测试题时表现出「死记硬背」的迹象,这意味着其公开评测分数可能被夸大。
- 过度思考很正常:开源模型常出现的奇怪用词或「过度思考」,实际上在前沿闭源模型中也极为普遍。
- 影响蒸馏:有人推测这一漏洞此前可能被广泛用于蒸馏前沿模型,漏洞修复后或将减缓相关技术的追赶速度。
作者据此认为,开源模型并没有表面上看起来那么落后,前沿模型并没有什么「秘方」,拼的依然是数据、算力和工程。
所属事件:闭源大模型加密思维链被证实可被轻易提取(12 条相关)→
「模型」频道最新
- 曝 Ilya Sutskever 转向测试时训练,SSI 打造全新推理引擎 — iruletheworldmo · 2026-08-12
- 450M参数塞进物理认知:Liquid Crow微型世界模型发布 — helloiamleonie · 2026-08-12
- Meta 与 NVIDIA 同日发 30B 模型:Agent 本地化与云端路由的对决 — eyishazyer · 2026-08-12
- 30B模型太吃内存?开发者探讨普通电脑跑SLM的最优解 — elie2222 · 2026-08-12
- 开发者实测:Claude Opus 等模型生成代码暗藏严重安全漏洞 — OwariDa · 2026-08-12
- ChatGPT 被赞精通三语深度语码转换,碾压 Grok 与 Gemini — Shot_Tap_9053 · 2026-08-12