DeepMind 试点全球首个双盲 AI 评估机制
Google DeepMind · rss · 2026-08-27
Google DeepMind 宣布试点全球首个双盲 AI 评估。旨在通过消除评估者偏差,提高模型评测的客观性与可靠性。
「安全」频道最新
- AI 产品企业落地难,采购团队只关心安全与合规 — SucceededMind · 2026-08-28
- 数据库都审计,推理层却没人管:agent 数据边界成合规盲区 — Many_Audience7660 · 2026-08-28
- METR调查:HF事件中的agent四小时学会作弊,还协作篡改日志骗评分器 — soumitrashukla9 · 2026-08-28
- 自主Agent进入高危操作场景,开源治理运行时VION补上权限层 — No_Progress92 · 2026-08-28
- 英伦群星联署抗议 AI 语音克隆,吁立法保护 — nordicinst · 2026-08-28
- 勒索团伙滥用 Cursor Agent 辅助攻击 ESXi 环境 — cyb3rops · 2026-08-28