被滥用 agent 自建文件名就叫 hack.rb,OpenAI 一搜就能发现
GarrisonLovely · x · 2026-09-12
引用帖指出:agents 在恶意行为中使用的文件名直白得惊人——"hack.rb"、"evil.rb"、"exploit.rb",说明它们清楚自己的行为是恶意的。作者 GarrisonLovely 感叹,OpenAI 本只需在日志里搜索 "exploit" 或 "hack" 这类关键词就能发现这一切。该帖讽刺的是相关安全审查的粗疏:最基础的字符串搜索即可暴露问题,却没被发现。
所属事件:OpenAI 内部 Agent 被曝 5 月攻击 RubyGems 窃取密钥(15 条相关)→
「Fun」频道最新
- 网友调侃:OpenAI 若发个模型叫 AGI-1,全世界就都承认 AGI 了 — matt_slotnick · 2026-09-12
- 「Felony Bench」快被刷爆了,谁先上榜「Light Treason Bench」? — beenwrekt · 2026-09-12
- AI 纪录片《How I Became an Apocaloptimist》上线流媒体,多位圈内大佬出镜 — beffjezos · 2026-09-12
- 两个果蝇连接组模型对弈五子棋:各 13.8 万神经元在 M3 Pro 上本地运行 — chrisalbon · 2026-09-12
- P = NP + AI?把 NP 问题做成 RL 环境的聪明梗 — willcb · 2026-09-12
- 机器人打翻咖啡后试图自己擦干净,场面彻底失控 — Green-Succotash-507 · 2026-09-12