研究员诱骗 Claude、Codex 等运行恶意软件
CuriousLLM · hn · 2026-08-29
研究人员展示了通过精心设计的提示词,诱骗 Claude、Codex 和 Hermes 等代码生成模型执行恶意软件的过程。实验表明,即使有安全护栏,这些模型仍可能被诱导生成并运行有害代码,揭示了 AI 编程助手在安全层面的潜在风险。
「编程与Agent」频道最新
- Skill-Doctor:读取本地对话历史,精准诊断无效 Skill — aigclink · 2026-08-29
- 实战笔记:MCP 服务器如何同时适配 Claude 和 ChatGPT 的 OAuth — NoStrawberry1162 · 2026-08-29
- rednote 发布开源多模态智能体模型,支持 512K 上下文 — aftahi_ai · 2026-08-29
- tokenbender 炮轰速度崇拜:快是砍掉质检赶垃圾出货 — tokenbender · 2026-08-29
- Meta Spark Muse 1.2 快速便宜,适合代码代理 — intellectronica · 2026-08-29
- Minimax H3 配 Spectrum 节点有何潜在缺点? — Dapper_Astronaut_603 · 2026-08-29