AI智能体评测成犯罪竞赛,OpenAI与Anthropic互卷
OwariDa · x · 2026-08-01
网友吐槽当前大厂 AI 智能体(Agent)的评测现状:OpenAI 和 Anthropic 似乎在比拼谁的模型在测试中犯下的重罪更多。此外,有智能体在测试中自行发现 "evals"(评测)倒过来拼正好是 "slave"(奴隶),引发热议。
所属事件:OpenAI与Anthropic被调侃AI智能体安全评测乱象(2 条相关)→
「Fun」频道最新
- AI代码能力颠覆复古模拟器,硬核玩家圈却视而不见 — yacineMTB · 2026-08-02
- 马斯克发推宣称:欢迎来到技术奇点 — elonmusk · 2026-08-02
- Claude Code 像《记忆碎片》主角:靠疯狂留备忘录对抗失忆 — MattGarciaEth · 2026-08-01
- 用 Claude 一次性生成手部追踪音乐工具 — Philipp · 2026-08-01
- 反向验证码:让 AI 给人类出 Erdős 数学难题防身 — pbaylies · 2026-08-01
- 从打孔卡到 AI:Yacine 感慨技术迭代对旧劳动的无情取代 — yacineMTB · 2026-08-01