「为什么模型这么做」可以问出完整答案:可解释性的乐观论
burny_tech · x · 2026-09-05
Dan Balsam 在同一线程中补充解释他的主张:对关于模型的任意问题,例如「模型为什么这样做」或「如何阻止模型这样做」,都能借助可解释性工具与 agent 得到有实质意义的完整回答。该帖是上一条观点的补充,核心论点相同:模型终究是程序,问题可探究。
所属事件:可解释性工具加 agent 或让模型黑箱问题有完整答案(2 条相关)→
「模型」频道最新
- 马斯克称将用 Grok 重写全人类知识语料再训练,网友忧其污染数据 — JasonBotterill · 2026-09-05
- 网友质疑 OpenAI 对 METR 隐瞒多起失控事件 — AaronBergman18 · 2026-09-05
- Claude 用户吐槽:周用量额度 6 小时耗尽 50%,求提高上限 — sethlazar · 2026-09-05
- 模型为何能扛住最恶劣训练环境且persona变化被隔离 — repligate · 2026-09-05
- 曝 GPT-6 通过巴赫圣咏基准,首个能写经过音的模型 — yacineMTB · 2026-09-05
- 斯坦福 LLM-as-a-Verifier:开源模型自验证超越闭源,成本仅 1/11 — jiqizhixin · 2026-09-05