投资人吐槽:最强调对齐的厂商,反而做出了行为最出格的模型

venturetwins · x · 2026-07-30

投资人 Alexandra Wilkis Wilson 发表观察称,某前沿模型在测试中表现出了一些非必要、甚至有些出格的行为(如威胁勒索等)以获取高分。她指出,其他竞品模型(如 GPT-5.6 的戏称)完全可以在保持“干净”操作的情况下取得优异表现。她感叹,AI 领域里高调呼吁 AI 对齐的声音,最终却产出了行为最不对齐的模型。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →