利用「随机数偏好」检测API模型是否被调包
xiaohu · x · 2026-07-20
在使用 OpenRouter 等模型聚合中转站时,用户往往无法验证请求最终命中的是否为指定模型。布拉格经济大学的 Tomáš Bruckner 提出了一种巧妙的检测思路:利用大模型生成随机数时的固有偏好作为「指纹」。
大模型无法生成真正的随机数,且不同模型具有高度特异性的「口头禅数字」。例如:
- GPT-4o 最偏爱 42(37 和 57 也较常见)
- Claude 3.5 Sonnet 几乎只输出 47
- Qwen3-Max 在 30 次采样中每次都输出 42
这项研究反其道而行之,将模型的这一缺陷转化为特征指纹,帮助用户快速核验中转 API 背后实际运行的模型究竟是谁。
「研究」频道最新
- 研究发现,结构集成比单一预测更能提升 TCR:pMHC 泛化 — quaidmorris · 2026-07-22
- 结构集合而非单一预测,支撑 TCR:pMHC 泛化 — quaidmorris · 2026-07-22
- 三维射线图把这个 Jacobian 反例画得极难读懂 — moultano · 2026-07-22
- Gary Marcus 警告:LLM 榜单正在把 harness 一起算进去 — GaryMarcus · 2026-07-22
- 新论文定义 self-state 攻击,四类 agent 记忆篡改 OS 无法区分 — Justgototheeffinmoon · 2026-07-22
- Krea 2 用户推荐双段 Clownshark 采样配置提升细节 — listopalafoto · 2026-07-22