与图像生成器吵架真能翻案:质疑审核理由后成功出图
FoundationXYZ · reddit · 2026-10-10
一位 Reddit 用户发现,当图像生成器反复以「违反暴力政策」拒绝出图时,直接用文字反驳、质问其拒绝理由,竟然能让它重新审视自己的政策并放行生成。
作者的猜测:图像生成器有一定推理能力——它会先看生成的画面本身是否血腥并拒判,但被新 prompt 直接挑战后,会被迫回头复查自己的政策判断,发现内容其实不违规。作者表示此后每次遇到政策拦截都会去争辩,成功率不错。
注意这是个人经验与推测,不含具体 prompt,但提示了媒体生成模型的审核层可能存在可对话博弈的空间。
「Fun」频道最新
- IKEA 开始卖假罗勒植物,网友直呼看不懂 — StephanSturges · 2026-10-10
- 用 Claude 两天做出「深山独居钓鱼」模拟游戏,想直接搬进去住 — prasenx · 2026-10-10
- ChatGPT 写小说时能直接生成带时间戳的聊天气泡,沉浸感拉满 — No_Brush5273 · 2026-10-10
- AI 灌水号进化出「短诗体」:7-10 词推文规避检测工具 — StewartalsopIII · 2026-10-10
- 网友误把 Pinterest 垃圾图当已故设计大师佐藤晃一作品,引发争议 — round · 2026-10-10
- 硅谷人不敢直视的情景喜剧:太真实又好笑又心酸 — julianharris · 2026-10-10