AI 监管难在模型可能生成看似正确的内容

JacquesThibs · x · 2026-08-19

JacquesThibs 指出,安全派人士相信 AI 在监控下能产生突破性研究且不会胡说八道,但这可能是一个误解。他解释说,向对方阐明 AI 为什么会“bullshit”(胡编乱造)至关重要,否则对方会误将批评者视为对 AI 能力的盲目无知。

所属事件:对齐圈激辩:当前风险是平庸技术失败还是哲学难题(7 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →