Kimi K3 开源网络攻击能力两月无实害,开源护栏缺位引争论
Kimi K3 开源发布约两个月后,其自带网络攻防能力曾引发社区哗然,但至今没有任何有记录的、可归因于 K3 的实际危害案例,为「开源前沿模型释放网络攻击能力是否必然导致滥用」提供了实证参考点。
已确认
- AISI/CAISI 等机构的谨慎评估显示,K3 的 cyber 能力约达到 Opus 4.6 水平。
- AlexBarry4 在长文中判断,Mythos/5.6-Sol 在网络能力上是巨大飞跃,目前阻止前沿模型被用于大规模破坏性攻击的主要是 Anthropic/OpenAI 部署的分类器等防线,而开源模型没有这层保护。
- xeophon 提出实验方案:对去安全层的 abliterated 模型跑 SWE 与 cyber 基准,他怀疑这些模型大多只是「装样子」,或 abliteration 本身反而降低能力;双方约定数月后回看验证。
尚未确认
- anthonyronning 以 K3 两月无实害为例回应质疑,xeophon 反驳称加密世界正接连发生重大黑客事件,但两者之间的关联缺乏证据,处于争论状态。
- 开源模型若在 1-2 个月内达到 Mythos/5.6-Sol 的前沿网络攻击水平,局势是否实质改变尚无答案,xeophon 表示 5、6 个月后回来验证。
- 关于 GLM abliterated API 的实际效果存在分歧:xeophon 认为对其过度兴奋没有必要,用 prompt injection 就能让闭源模型绕过拒绝。
为什么重要
- 这一案例为开源模型安全治理争论提供了少见的实证观察窗口:高 cyber 能力开源发布未必立刻导致滥用,但厂商分类器这层防护在开源生态中确实缺位,未来开源能力逼近前沿时的风险仍待验证。
2026-09-10 ~ 2026-09-10 · 7 条相关
一手来源
- Kimi K3 发布两个月:开放网络攻击能力至今无实际危害案例 — xeophon ·
- 挡住 AI 网络攻击的只有厂商分类器,开源模型护栏缺位引发担忧 — AlexBarry4 ·
- 开源模型网络攻击能力逼近 Opus 4.6,K3 未致实害但趋势引忧 — xeophon ·
- 【源头】Kimi K3 发布两个月:开放网络攻击能力至今无实际危害案例 — xeophon · 2026-09-10
- Kimi K3 开放网络能力两月无实锤危害,加密圈黑客频发引争论 — anthonyronning · 2026-09-10
- 【源头】开源模型网络攻击能力逼近 Opus 4.6,K3 未致实害但趋势引忧 — xeophon · 2026-09-10
- 【源头】挡住 AI 网络攻击的只有厂商分类器,开源模型护栏缺位引发担忧 — AlexBarry4 · 2026-09-10
- 网友约定半年后回看:开源模型达到前沿网络攻击能力会怎样 — xeophon · 2026-09-10
- 「abliterated」开源模型被疑只是摆设,提议跑 SWE 与 cyber 基准验证 — xeophon · 2026-09-10
- 「去审查版」模型多是花架子?开发者提议用 SWE/Cyber 基准实测 — AlexBarry4 · 2026-09-10