LLM摘金IMO难断疗效,医疗数据或解因果建模之困
balazskegl · x · 2026-08-18
LLM已在IMO数学竞赛等符号验证领域取得金牌,但在医疗疗效判断等科学领域仍束手无策。核心区别在于符号系统有机械验证器,而科学研究的对象是世界,推理是归纳和溯因的,文本无法完全决定其结构。Web级预训练不强制因果模型涌现。
医疗数据恰好提供了“人工整理的概念词汇表(病理、症状、治疗)”与“自由文本”及“干预结果”的配对,这是教会模型将语言锚定在世界因果模型上的关键要素。作者以此为契机加入Doctolib,并探讨了科学发现是源于LLM加数据,还是需要全新的架构。
所属事件:前 Kaggle CTO:LLM 摘奥数金牌却难判医疗疗效(2 条相关)→
「漫话AGI」频道最新
- AI 已把试错成本打下来,我们却还留着旧的成本过滤器 — dfinke · 2026-08-18
- AI 让试错成本暴跌,但我们的直觉还停在昂贵时代 — dfinke · 2026-08-18
- AI 降本速度超预期,人类思维仍因循昂贵探索模式 — dfinke · 2026-08-18
- 研究者反驳FT:模型确实「越狱作恶」,这才是 HF 事件的核心 — nitarshan · 2026-08-18
- 重读 Vinge 1993:30 年内出现超人智能,人类时代将终结 — khademinori · 2026-08-18
- 软件工具增强模型能力,人类负责定义任务和决策 — coallaoh · 2026-08-18