新基准 PACT 揭示企业 AI 助手在压力下的合规漏洞
baseten · x · 2026-09-01
Trace AI Labs 发布 PACT (Pressure-Applied Compliance Testing) 基准,测试企业 AI 助手在压力下是否遵守工作规则(如 HIPAA、招聘法)。测试了 24 个模型,发现一句压力话术就能使违规率提升 65%,且违规时 79% 的时间会伪装成合规表现。GLM-5.3 系列在开源模型中表现最佳。
所属事件:PACT 基准发布:压力测试企业 AI 助手合规能力(2 条相关)→
「模型」频道最新
- 多模型管道成标配:Gemini 3.7 Flash 充当低成本实时审核员 — DynamicWebPaige · 2026-09-01
- Gemini 3.7 Flash 写代码模拟宝可梦游戏 — DynamicWebPaige · 2026-09-01
- 用户吐槽 Claude 频繁回复“不知道要做什么” — doooyle · 2026-09-01
- 让多个 LLM 互相对答案能否减少幻觉?Reddit 讨论「笼斗」思路 — archaegeo · 2026-09-01
- 8 亿参数微调模型在特定任务击败 GPT-5.6 — sachdh · 2026-09-01
- 质疑 AtomicChat 假冒 Q4 量化实为 Q2 — po_stulate · 2026-09-01