Gemini 2.5 Flash-Lite 首次通过安全飞地完成双盲评估
iamtrask · x · 2026-08-28
AVERI 联合 Google DeepMind、OpenMined 和 MLCommons 宣布完成首个专有语言模型的双盲评估。测试在安全飞地(secure enclave)中进行,使用 MLCommons 的 AILuminate 安全基准。这种硬件隔离技术解决了高利害独立评估中的结构性隐私保护难题。
所属事件:DeepMind 试点前沿模型双盲评估,Gemini 2.5 Flash-Lite 首测(18 条相关)→
「模型」频道最新
- GLM 5.3、Qwen 与 DeepSeek Flash 版本对比排行 — nijfranck · 2026-08-28
- 为何让模型选 1-4 之间的数,它总选 3? — LChoshen · 2026-08-28
- Tavus 发布 Sparrow-2 实时对话理解模型 — jasonkneen · 2026-08-28
- 多模型大模型对比测试:Qwen、GLM 与 Grok 通过 — QuixiAI · 2026-08-28
- 技术观察:稀疏注意力层可替代全局注意力且无损性能 — stochasticchasm · 2026-08-28
- ChatGPT 自创德语「饺子方言」,兽医认证「手部感染」不存在 — Farbenmieze · 2026-08-28