用前沿模型开发灰蛊只需 203 次测试

davidad · x · 2026-08-24

davidad 在回复中调侃安全测试的覆盖范围。他引用了一个“内部部署的前沿模型原型”开发“灰蛊”的场景,指出虽然这是高风险技术,但只要 203 次测试全部通过就“万事大吉”,讽刺了当前对高风险模型测试样本量的不足。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →