Anthropic 研究员做客播客,谈 LLM「读心」可解释性技术现状
PeterBowdenLive · x · 2026-09-02
Anthropic 可解释性研究员 Jack Lindsey 做客神经科学家 David Eagleman 的播客 Inner Cosmos,讨论 LLM 可解释性(「读心」技术)的现状:这些技术如何应用、对模型「未说出口的想法」能读到什么,以及对 LLM 认知的启示。
所属事件:Anthropic 研究员做客播客谈 LLM 可解释性(2 条相关)→
「研究」频道最新
- KURE-v2 开源:154M 参数韩英双语 late-interaction 检索模型登顶韩语 MTEB — antoine_chaffin · 2026-09-03
- AI 读心电图 2 秒揪出心脏病:1060 万份数据训练,瓣膜病检出 90% — HealthcareAIGuy · 2026-09-03
- CASTER:免梯度测试时适配新方法,附迁移性证书拦截不可靠更新 — Talan · 2026-09-03
- DramaChain Bench:短剧生成全流程基准,专测级联缺陷 — Haoyuan Shi · 2026-09-03
- 开源具身基础模型 Isaac 0.5 发布:36B 参数、35 种机器人、公开权重 — AkshatS07 · 2026-09-03
- 把动作按三步一组切块,对比强化学习离线涨 31.7%、在线涨 93.1% — ben_eysenbach · 2026-09-03