开源最全提示词黑客教程:涵盖越狱与红蓝队攻防
tom_doerr · x · 2026-08-09
TrustAI 实验室在 GitHub 开源了名为 Learn-Prompt-Hacking 的综合教程项目。
该教程系统性地梳理了提示词工程与大模型安全攻防体系,主要包含:
- 基础与应用:提示词工程技术和 GenAI 开发技术
- 红队攻防:ChatGPT 越狱、GPTs 提示词注入与泄露、对抗性机器学习
- 蓝队防御:LLM 安全防御技术、推理强化
- 资源集合:LLM 安全相关论文、会议幻灯片及测试基准
「编程与Agent」频道最新
- AI 记忆系统的设计悖论:为何不让模型自己提取记忆? — mertdumenci · 2026-08-09
- 实测提示词注入:最强模型反而中招,安全需靠架构而非模型 — Dangerous_Bus4157 · 2026-08-09
- AllMCPs 上线:专为 Agent 设计的免费 MCP 服务器发现平台 — moxie-docs · 2026-08-09
- 实测 LLM 路由器:成本降低 35%,质量反而提升 1.3% — zainhas · 2026-08-09
- 开源 AI 框架 LifeOS:用大模型将自我提升变成「引导式优化过程」 — tom_doerr · 2026-08-09
- 「就再加一个工具」:AI Agent 工作流中的工具堆砌与精神错乱 — DavidWells · 2026-08-09