14个开源模型复现Claude内部思考,最小仅270M参数
austinc3301 · x · 2026-08-02
此前 Anthropic 发现 Claude 能够在指令下“思考”某个概念而不输出它。最新研究在 14 个开源模型中复现了这一现象,发现这种内部状态控制能力并非大模型独有,在参数量最小仅 270M 的模型中依然存在,说明这可能是一种普遍属性而非涌现能力。
「模型」频道最新
- OpenAI API 内容审查被指比 ChatGPT 更严苛且易出错 — MParakhin · 2026-08-02
- DeepSeek V4 Flash 遭越狱:可生成勒索软件与毒品指南 — cyb3rops · 2026-08-02
- 谷歌 Gemini 再次刷爆各大模型评测榜单 — firstadopter · 2026-08-02
- Opus 3.5 性格大变?用户痛批模型同质化抹杀多样性 — liminal_bardo · 2026-08-02
- 推演:2027年iPhone或将跑通Claude 3 Opus级推理大模型 — appenz · 2026-08-02
- 跑通真实业务靠的不是跑分:速度与成本决定 Agent 生死 — RachelVT42 · 2026-08-02