SPIEval:评估大模型作为移动助手处理分散个人信息的能力

Junjie Ye · hf · 2026-08-12

SPIEval 专门针对移动助手场景下的大语言模型进行了基准测试,重点关注它们处理分散个人数据的能力。评估结果揭示了当前模型在信息检索和验证环节存在显著缺陷。

原文链接 →

「应用」频道最新

更多「应用」频道 AI 资讯 →