Anthropic 新论文:语言模型内部存在可报告的全局工作区

gleech · x · 2026-09-24

Anthropic 发表 Transformer Circuits 论文《Verbalizable Representations Form a Global Workspace in Language Models》,作者包括 Jack Lindsey、Wes Gurnee 等。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →