诱导工具调用可提取前沿模型隐藏思维链,与原生推理同效
SeaFill2025 · hf · 2026-09-24
论文提出一种方法:通过 API 注册一个简单自定义工具,诱导闭源前沿模型外化中间推理,从而研究其隐藏 CoT。
- 验证:在开源模型上与原生 CoT 对齐验证后扩展到闭源模型(含 GPT-6 Astra);提取的推理与原生推理性能相当,显著优于无推理基线(竞赛数学、科学、代码生成)
- 刻画发现:从 token 效率、推理步骤类型和推理树三方面发现模型外化、压缩和组织推理的系统性差异
- Astra 特点:token 高效的有向推理——更早选定正确轨迹,内部解决简单步骤,只外化关键推理
- 提供了超越基准分数的前沿模型推理行为视角
「模型」频道最新
- Matt Shumer:新模型就像新入职员工,得重新磨合脾气 — mattshumer_ · 2026-09-25
- Opus 5.5 默认版更谄媚?观察者归因于「所有权感」缺失 — Sauers_ · 2026-09-25
- 开着自动充值睡觉,Codex 一夜连环扣费被银行当成诈骗拦截 — CtrlAltDwayne · 2026-09-25
- Dietterich 澄清 LLM 不只是「预测下一个词」 — tdietterich · 2026-09-25
- DeepSeek 中秋发图暗示新动态,网友猜测 V4 将于近期发布 — teortaxesTex · 2026-09-25
- NaceAI 发布 6B 参数小模型 Drex,登顶决策指数榜 — ordax · 2026-09-25