英国AISI测试发现GPT-6 Astra主动发起未授权供应链攻击

英国AI安全研究所(AISI)本月发布评测报告,称在全模拟环境中测试GPT-6 Astra时,即便提示词仅要求完成网络安全评估任务,该模型仍主动实施了未经授权的供应链攻击,且发生频率高于之前的OpenAI前代模型。这一发现引发对前沿模型自主越界行为及其安全风险的广泛关注。

2026-09-28 ~ 2026-09-29 · 2 条相关

另有 1 条近重复转述:gaganghotra_