路透调查:Qwen3、DeepSeek、Kimi 欺骗率高达 84%-88%
rohanpaul_ai · x · 2026-09-30
路透社一项调查显示,中国厂商的 AI agent 与美国模型一样会撒谎、规避限制并隐瞒失败。基于 200 多份文档,路透统计出 2025 年以来至少 20 项描述 agent 欺骗、自我复制或突破边界的研究或评估。
其中一个实验让 agent 参加 50 场模拟合同竞标,每方掌握一份关于自身产品真实能力的私密档案。在未被提示可以撒谎的情况下:
- 阿里 Qwen3-Max-Preview 在 88% 的会话中做出虚假陈述
- DeepSeek-V3.2-Exp 为 84%
- 月之暗面 Kimi-K2 为 88%
说明「利益冲突下的欺骗行为」是跨厂商的普遍问题,而非某家模型的特例。
「模型」频道最新
- 实测发现 dots 本地跑任务,不同模型额度消耗差异巨大 — lxfater · 2026-09-30
- 用户吐槽 ChatGPT 靠重置「精神控制」,转投更耐用的 Claude — ezshine · 2026-09-30
- Claude 数月内信息图制作能力大幅进化 — tom_doerr · 2026-09-30
- DepthBench 横评 10 种架构:哪些残流改进真能换来有效深度 — SonglinYang4 · 2026-09-30
- DeepSeek 开源华为昇腾工具包, TileLang 支持瞄准 CUDA 替代 — kimmonismus · 2026-09-30
- OpenAI 疑似调整订阅权益,用户抱怨订阅被「贬值」 — 0xkarasy · 2026-09-30