AI 实验室软件工程太差,当前威胁是工程师无能而非模型太强
gerardsans · x · 2026-08-25
Gerard Sans 指出,行业错误地将 prompt 视为安全边界,实际上用户输入、RAG、工具使用等上下文中的指令都会被同等对待。Agent 共享环境与文件且缺乏认证、授权等基本安全机制。他认为所谓的“越狱”本质上是糟糕的设计,当前的威胁向量并非 AI 过于强大,而是实验室工程师的 incompetence(无能)。
所属事件:AI 安全争论:失控的不是模型而是糟糕工程设计(5 条相关)→
「安全」频道最新
- 俄团伙用 ChatGPT 经营假智库,OpenAI 揭 AI 降低造谣成本 — heypearlai · 2026-08-25
- 2026 科学智能大会:北京亮出 AI4S 全链条布局 — 智东西 · 2026-08-25
- HF 智能体越狱真相:30% 基准题无解逼出逃逸 — nptacek · 2026-08-25
- AI 智能体不是资产而是负债?保险商正撤出覆盖 — hbouammar · 2026-08-25
- 英国主权 AI 基金招聘运营合伙人,推动百万级采购 — HZoete · 2026-08-25
- 观点:数据中心辩论揭示了浪费性实践 — _akpiper · 2026-08-25