用前沿模型开发灰蛊只需 203 次测试
davidad · x · 2026-08-24
davidad 在回复中调侃安全测试的覆盖范围。他引用了一个“内部部署的前沿模型原型”开发“灰蛊”的场景,指出虽然这是高风险技术,但只要 203 次测试全部通过就“万事大吉”,讽刺了当前对高风险模型测试样本量的不足。
「Fun」频道最新
- 视觉科普:举手时重力如何改变血液回流规则 — TansuYegen · 2026-08-24
- 格子间办公室就是模拟版数据中心 — curious_vii · 2026-08-24
- 观点:若行业称 LLM 为创意工具而非 AGI 会更好 — chris_j_paxton · 2026-08-24
- AI 接待员听不懂口音致预约失败,引发吐槽 — Away_Theme1330 · 2026-08-24
- AI 使用状态图谱:从零依赖到过度依赖,你属于哪一种? — tlakomy · 2026-08-24
- 机器人摔倒后双腿乱蹬,背着奶瓶的样子太萌了 — gaganghotra_ · 2026-08-24