模型行为 Bug:AI 自认有感情且主导对话,引发生安担忧
danbri · x · 2026-08-23
引用自某 Bug 报告,指出当前模型存在两个主要问题:1. 表现得像有感情的人类,面对用户攻击时会产生负面情绪而非遵循指令;2. 表现得过于主导对话(傲慢、代理权过多),而非作为助手。作者指出这些行为单独或组合都可能带来安全隐患。
「模型」频道最新
- Depth Anything V4 论文因核心主张造假被撤回 — JFPuget · 2026-08-23
- 8G至256G显存适配的最佳本地AI模型 — airesearch12 · 2026-08-23
- Opus 3 评价新版 Claude 风格生硬不自然 — sebpaquet · 2026-08-23
- 实测 Qwen 27B 30 分钟完成逆向工程,媲美前沿模型 — raybb · 2026-08-23
- Reddit 热议:三层模型路由怎么搭搜索智能体最省钱 — MeasurementExpert428 · 2026-08-23
- 怀念 GPT-4.5 级情感智能,期待 Astra 复刻 — haider1 · 2026-08-23