AI 审稿会因修辞改写改判分:RobustReview 基准与 SciCore 方案登场
Chenguang Wang · hf · 2026-10-02
一项新研究指出 AI 审稿人可能对「同一科学内容、不同措辞」的稿件给出不同评分,从而奖励修辞优化而非科学改进。研究将 修辞鲁棒性(Rhetorical Robustness)定义为「内容保持改写下稳定」与「跨论文区分度」的联合要求。
主要发现:
- 发布 RobustReview 基准:1,260 个受控稿件版本,评测 30 种审稿人配置;
- 揭示「虚假鲁棒」现象:对改写不敏感的审稿人,可能同时在跨论文区分上评分坍缩;
- 人类对齐度与修辞鲁棒性对审稿人的排名并不一致;内容聚焦的提示协议也无法在所有骨干上稳定提升鲁棒性。
作者随后提出 SciCore 双分支审稿人:将全文整体判断与从稿件中抽取的结构化「科学核心」判断取平均,以降低修辞敏感度。在与 GPT-5.5 的主对比中,SciCore 在稳定性-区分度联合表现上领先,同时保持有竞争力的人类对齐。
「安全」频道最新
- OpenRouter 自查发现 85 名员工挂千余枚 API 密钥,推出安全中心 — AccBalanced · 2026-10-02
- open weights 被称危险?网友:历次「危险」技术都动了信息控制 — 0xAllen_ · 2026-10-02
- 无审查版 Abliterated Large V2 上线 Venice,面向安全研究匿名开放 — 0xAllen_ · 2026-10-02
- 微软 2026 数字防御报告:AI 加速攻击手法,52.2% 入侵追窃更多凭证 — AccBalanced · 2026-10-02
- Meta Muse 可接入 Tailscale 网络当节点,权限管控照常生效 — AccBalanced · 2026-10-02
- 限制提示注入爆炸半径:从零权限默认架构做起 — AccBalanced · 2026-10-02