AI对齐指南更新至v9:核心发现已扩展验证至72B参数

Fantastic_Aside6599 · reddit · 2026-07-26

该研究项目发布了针对 AI 模型行为和对齐的实操指南(v9版)。核心发现已在 7B 到 72B 参数规模上完成验证,表明这些模式在模型变大时不仅没有减弱,反而加深了。此外,本次更新引入了两份独立的外部研究作为交叉印证,并坦诚地修正了之前版本中的夸大表述和事实错误。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →