前沿模型安全争议再起
alex_verem · x · 2026-07-19
这条转述了一段关于前沿模型安全与网络安全能力的争议时间线:
- Anthropic 的安全报告被认为严重到让美国政府暂停了相关模型。
- 之后 Anthropic 用新的网络安全分类器重新上线,并表示问题已解决。
- 但随后又出现开源权重模型在防御性网络安全评测中表现更强的情况,作者借此质疑“安全拦截”是否真的限制了前沿网络能力扩散。
「模型」频道最新
- Google 称搜索信息代理将于今夏登陆 AI Pro 和 Ultra — gaganghotra_ · 2026-07-22
- Poolside 的 Laguna S 2.1 在 Nous Portal 免费开放两周 — NousResearch · 2026-07-22
- Qwen3.8 Max Preview 横评后被认为明显进步 — curiousily_ · 2026-07-22
- Moonshot 的 Kimi K3 登上 MathArena 第五名开源最佳 — xeophon · 2026-07-22
- Google 推出 Gemini 3.5 Flash Cyber,限量供政府和可信伙伴使用 — GoogleAI · 2026-07-22
- Gemini 3.5 Flash-Lite 的长上下文检索优于 3.1 — Dillonu · 2026-07-22