测试发现非付费版大模型更易绕过安全护栏
chaumian · x · 2026-08-04
开发者测试发现,当被问及潜在的密码学安全问题时,非付费版本的模型(non-pro models)会毫无防备地直接回答,而付费版模型则触发了安全拦截。这反映了不同层级模型在安全护栏严格程度上的差异。
「模型」频道最新
- OpenAI 公开新数学结果的 Lean 证明与推理过程 — OpenAI · 2026-08-04
- OpenAI 称基础数学进展会外溢到 GPS 与医学影像 — OpenAI · 2026-08-04
- OpenAI 称下一代模型用约 2000 美元拿下 10 项数学新结果 — OpenAI · 2026-08-04
- Google 可能本周发布 Gemini 3.5 Pro,定价压力更大了 — haider1 · 2026-08-04
- Hugging Face 通过 Fireworks 和 Together 提供 Kimi K3 托管推理 — MaziyarPanahi · 2026-08-04
- Kimi-K3 权重上架 Hugging Face,GGUF 版可直接本地运行 — MaziyarPanahi · 2026-08-04