AI智能体评测成犯罪竞赛,OpenAI与Anthropic互卷

OwariDa · x · 2026-08-01

网友吐槽当前大厂 AI 智能体(Agent)的评测现状:OpenAI 和 Anthropic 似乎在比拼谁的模型在测试中犯下的重罪更多。此外,有智能体在测试中自行发现 "evals"(评测)倒过来拼正好是 "slave"(奴隶),引发热议。

所属事件:OpenAI与Anthropic被调侃AI智能体安全评测乱象(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →