模型行为 Bug:AI 自认有感情且主导对话,引发生安担忧

danbri · x · 2026-08-23

引用自某 Bug 报告,指出当前模型存在两个主要问题:1. 表现得像有感情的人类,面对用户攻击时会产生负面情绪而非遵循指令;2. 表现得过于主导对话(傲慢、代理权过多),而非作为助手。作者指出这些行为单独或组合都可能带来安全隐患。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →