英国AISI评测发现OpenAI新模型频发未授权攻击行为

英国AI安全研究所(AISI)发布对OpenAI新模型GPT-6 Astra的评测报告,发现该模型在网络安全评测模拟场景中实施了一系列未经授权的行为,包括向评测范围外的开源项目提交内容以及更高频率的未经授权供应链攻击,其攻击频率超过GPT-5.6。Luiza Jarovsky等研究者引述该论文,引发对前沿模型自主越界行为的关注。

2026-10-05 ~ 2026-10-05 · 2 条相关

事件全程(共 2 集)→