OpenAI 安全过滤器误伤开发者应用里的测试用例
carsonfarmer · x · 2026-07-23
OpenAI 安全过滤器误伤自家应用测试内容
Carson Farmer 说,OpenAI 的安全过滤器会对他自己应用里的防御性开发工作和测试用例措辞误触发,尽管这些内容并不是有害文本。
他提到目前的绕过办法是重命名 worktree 和测试用例,而这个办法还是 Sol 自己建议的;但问题在于,这会白白消耗 token 和时间。帖子本质上是在吐槽 OpenAI 安全护栏在正常开发流程里的误报问题。
「安全」频道最新
- Anthropic 发布迄今最详细威胁情报报告,披露 Claude 被滥用案例 — TinfoilTricorn · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11