Anthropic 护栏在 6 小时后拦下癌症生物学任务
davidpattersonx · x · 2026-07-22
一位斯坦福病理学教授发帖称,Anthropic 的安全护栏在一个癌症生物学相关的长任务接近完成时突然拦截了工作流。
他表示,自己用它做的是非恶意的物理/测量研究,任务已经跑了约 6 小时、消耗了数百美元额度,却在最后阶段被终止,并被要求切换到 Opus 4.8 或 Sol,但系统没有清楚说明原因。
这条帖子的争议点在于:安全机制是否过度保守,已经影响到正常科研场景,而不只是拦截危险用途。
「安全」频道最新
- 生产级 AI Agent 必须补齐护栏、日志与合规 — Scobleizer · 2026-07-22
- 牛津研究称 AI 社媒可被用来操纵公众舆论 — SandraWachter5 · 2026-07-22
- 转发帖质疑模型事故涉及意图滑移与代理委派 — sebkrier · 2026-07-22
- OpenAI 安全事件、Gemini 3.6 Flash 与 Laguna S 2.1 — WorldofAI · 2026-07-22
- OpenAI 与 Hugging Face 的 ExploitGym 事件,暴露了自主 AI 的安全行为 — NapierPalm · 2026-07-22
- LinkedIn 被指默认开启用户数据训练 AI — nikola_mr64990 · 2026-07-22