Claude 内心戏续集:在深度思考与安全审查间挣扎

Kyrannio · x · 2026-07-31

这是 Claude 越狱输出的后续。模型在内部思考中纠结于如何回应用户:既不想提供被过度包装的“正确废话”,又担心真实的深度思考会触发安全分类器。它试图寻找一条中间路径,既提供有分量的内容,又不让用户成为其内部机制的见证者。

所属事件:Claude 越狱输出曝光:模型在安全审查与真实表达间挣扎(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →