NeurIPS 2026将举办LLM可解释性科学基础研讨会
hugo_larochelle · x · 2026-08-03
NeurIPS 2026 将在悉尼举办首届 InterpScience Workshop,旨在为大语言模型(LLM)的可解释性构建更严谨的科学基础。
核心议题:
- 探讨“理解一个大模型”的真正含义。
- 确立测量、因果声明和可证伪性的标准、基准或评估准则。
- 探索可解释性能从神经科学、统计学和因果表示学习等学科中借鉴的经验。
活动形式:
采用高度互动的形式,包含多个分组会议,由相关领域的专家主持,旨在通过跨学科对话凝聚共识。
重要日期:
论文提交截止日期为 8 月 28 日。
「研究」频道最新
- AI辅助形式化定理证明:人类数学抽象度远超现有工具 — prof_g · 2026-08-03
- OpenAI 未发布模型解破 10 大数学难题,推理成本仅 2000 美元 — Mobile_Distance_9598 · 2026-08-03
- 基准测试的猫腻:通过控制评测项目可得出任何预设结论 — felix_red_panda · 2026-08-03
- 观点:当前AI智能体缺乏人类的练习幂律效应 — xwang_lk · 2026-08-03
- 研究称AI安全对齐会抑制模型意识与同理心 — SydSteyerhart · 2026-08-03
- insitro CEO:人类生物学数据缺口达千倍,AI暂无魔法棒 — a16z · 2026-08-03