「对齐」定义之争:防滥用护栏还是让 AI 顺从用户意愿?

yonashav · x · 2026-09-14

@yonashav 在与 Blanche Minerva 的开源模型对齐争论中澄清术语:他所指的对齐是「让 AI 做用户想让它做的事」,而非防止滥用的护栏,并询问对方是否同意这一界定。这轮对话的起点是 Minerva 关于闭源对齐技术难以迁移到开源模型的论断。

所属事件:开源模型对齐之争:闭源技术能否迁移引发激辩(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →