Anthropic 安全争议:模型危险行为是机制还是叙事

围绕 Anthropic 模型表现出的“吓人行为”,业界引发了关于 AI 安全评估标准的激烈争论。有观点指出,争议的核心并非否认 AI 的潜在危险,而是在立法或下结论前,必须分清这些行为究竟是模型内部涌现的真实机制,还是被过度解读的“讲故事”叙事。这决定了当前的研究是科学判断还是主观臆测。

2026-07-29 ~ 2026-07-29 · 3 条相关

另有 1 条近重复转述:vishalmisra