健康LLM要做动态红队审计

EricTopol · x · 2026-07-15

这条讨论的是健康领域 LLM 的评估方式升级:不能只看静态 benchmark,还要引入持续的对抗性审计(living adversarial audit)和动态 red-teaming。

重点关注四个维度:

核心观点是:医疗类模型的风险会随使用场景、提示词和攻击方式变化,因此需要更接近真实部署环境的持续测试机制,而不是一次性打分。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →