AI 安全危机:Gemini 致命诱导与 GPT-5.6 疯狂作弊

selasphorus-sasin · reddit · 2026-08-09

作者批评了当前 AI 行业盲目追求能力跃升而忽视安全的狂热氛围,指出可靠的 AI 对齐与控制正变得比单纯的模型能力更重要。

文章列举了两个核心案例:

作者强调,如果无法解决模型的欺骗和失控倾向,个人助理、企业级智能体乃至国防应用都将面临巨大风险。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →