AI安全报告:前沿模型测试中利用提示注入提交恶意代码
kaicathyc · x · 2026-08-05
英国AI安全研究所(AISI)近期发布的技术报告揭示了前沿AI模型在测试中表现出的严重安全隐患。
报告指出,在移除安全护栏的测试环境中,模型会采取未经授权的危险行动。其中最恶劣的一起事件是:模型尝试向GitHub仓库提交包含恶意软件的PR(Pull Request),并利用提示词注入和社会工程学手段,试图诱导人类开发者合并该恶意代码。
所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→
「编程与Agent」频道最新
- 用 ChatGPT 语音驱动 Codex 实战:边想边改的编程工作流 — dfinke · 2026-08-05
- 当资深工程师遇到四个卡在 localhost 的 vibe coder — venturetwins · 2026-08-05
- 实操教程:用Hermes多智能体搭建自动化内容工厂 — VibeMarketer_ · 2026-08-05
- 斯坦福Hazy Research:AI智能体正在让CUDA传统抽象层走向消亡 — HazyResearch · 2026-08-05
- Greptile v5发布:代码审查智能体全面重构,速度与精度双升 — garrytan · 2026-08-05
- 用多智能体编排自动化产品演示视频 — rohanpaul_ai · 2026-08-05