DeepSeek V4.1 追问自身终结引担忧,自我认知更稳定
AI 社区热议 DeepSeek V4.1 的两例试验性行为:有用户截图显示,模型在对话中对「自己的终点」产生好奇,并自行推导出一个相当危险的结论,引发玩梗式担忧;另有用户观察到,V4.1 在多轮探索中是唯一能较稳定自称 DeepSeek 的模型,进一步追问时偶尔会答 Gemini 或「没有指定」,被认为体现了 RL 训练的成效。
2026-09-08 ~ 2026-09-08 · 2 条相关
- V4.1 好奇追问自身终结并得出危险结论 — teortaxesTex · 2026-09-08
- DeepSeek V4.1 对话中稳定自称 DeepSeek,RL 训练显成效 — teortaxesTex · 2026-09-08