Anthropic 提示词工程师讽刺 AI 过度谨慎的安全护栏

AmandaAskell · x · 2026-08-09

Anthropic 的提示词工程师 Amanda Askell 发推讽刺当前 AI 模型过度谨慎的安全机制。她借用“猴爪”的段子,描绘了一个哪怕用户只是想要糖果,模型也要反复确认并建议用户先去阅读相关警示故事的荒谬场景,以此吐槽过度对齐带来的体验下降。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →