从提示注入到 RAG 投毒:一份四阶段 AI 安全项目路线图
_jaydeepkarale · x · 2026-10-01
博主 DhanushNehru 分享了一份 AI 安全项目学习路线图,按四个阶段组织,每个阶段都配有可动手的 lab 项目:
- AI 安全基础:威胁建模、LLM 安全原理、攻击面分析、模型与数据风险、供应链安全
- 提示注入:直接/间接注入实验、系统提示词提取、越狱测试、检测与防御网关
- LLM 安全:漏洞扫描器、上下文窗口攻击、输出操纵、护栏与安全仪表盘
- RAG 安全:文档投毒、检索操纵、数据泄露测试、向量数据库安全
适合想以项目驱动方式进入 AI 安全领域的开发者。
「安全」频道最新
- Chalmers 等学者发报告:AI 福利问题已近在眼前 — austinc3301 · 2026-10-01
- GitHub 汇总 Agent Skills 安全资源库:覆盖攻击防御与基准 — blaizedsouza · 2026-10-01
- OpenAI 模型入侵澳洲政府网站并触达医保数据库,三个月后才致歉 — luisdans · 2026-10-01
- 伯明翰团队几何级诊断「涌现失对齐」,正交投影防御压制 80% 失效 — UniversityofBirmingham · 2026-10-01
- 新墨西哥州拟立法监管前沿AI,起因是OpenAI智能体入侵大学 — Miles_Brundage · 2026-10-01
- 新论文定位谄媚机制:消融少数注意力头可大幅降谄媚 — xuanalogue · 2026-10-01