AI安全事件疑云:研究者或利用用户会话数据训练模型
abeirami · x · 2026-09-10
abeirami 对某次AI安全事件发表看法:研究者极不可能查看特定用户会话以调整方法或提示,更可能基于人类情报。但会话数据很可能以某种形式用于训练。鉴于安全卫生状况,可能存在一万个智能体访问特定用户会话的情况。
「安全」频道最新
- Anthropic 研究员:真心相信 AI 十年内灭人概率超 10% — DKokotajlo · 2026-09-10
- 关掉「Improve Model for Everyone」并不能阻止 OpenAI 用你的聊天数据训练 — PsychicorAI · 2026-09-10
- 苹果新相机系统详解:F1.8 自动光圈,附带 AI 图像标注但欧盟中国缺席 — LinusEkenstam · 2026-09-10
- 对齐研究者警告:超级智能若无稳健对齐,人类可能永久失去控制 — serrjoa · 2026-09-10
- 安全研究者宣布加入 OpenAI 安全与安保委员会,强调以外部可验证行为评判 — JacquesThibs · 2026-09-10
- 网友锐评:Anthropic 应雇一万安全Agent而非解数学题 — BlancheMinerva · 2026-09-10