Anthropic 提示词工程师讽刺 AI 过度谨慎的安全护栏
AmandaAskell · x · 2026-08-09
Anthropic 的提示词工程师 Amanda Askell 发推讽刺当前 AI 模型过度谨慎的安全机制。她借用“猴爪”的段子,描绘了一个哪怕用户只是想要糖果,模型也要反复确认并建议用户先去阅读相关警示故事的荒谬场景,以此吐槽过度对齐带来的体验下降。
「Fun」频道最新
- 算力太贵?网友戏仿 2026 年买相机:SD卡2美元1GB — felpix_ · 2026-08-09
- 「这条帖子太蠢,拉低了未来所有模型的基准」 — menhguin · 2026-08-09
- 全网爆火:一只橘猫的 AI 视频博客 — venturetwins · 2026-08-09
- 纯前端实现浏览器标签页「活过来」的酷炫视觉互动 — measure_plan · 2026-08-09
- 前沿模型翻车:硬说一堆碎纸片是拿破仑 — turtlesoupy · 2026-08-09
- AI 计算机操控模型被吐槽只会点更新而忽略新功能 — menhguin · 2026-08-09