开权重模型将网络安全差距缩至4到7个月,Kimi K3 订阅受限
rohanpaul_ai · x · 2026-07-21
Rohan Paul 的这期 newsletter 汇总了多条 AI 进展: - 在**长周期网络安全能力**上,领先的开权重模型现在只比闭源前沿落后 **4–7 个月**,而 2025 年大部分时间这个差距还是 **6–10 个月**。 - 一项关于 AI 建议的研究指出,即使准确性被激励,模型建议也会让人更不愿意说出 **“我不知道”**。 - **Kimi K3** 在一个要求很高的自主法律工作 benchmark 上,成绩几乎是最近竞争对手 **Claude Fable 5** 的 **2 倍**。 - 但 Kimi K3 也被提到修复了 **15 个严重安全漏洞**,而 Codex 和 Fable 因 cyber guardrails 拒绝处理。 - newsletter 引述的一篇观点文强调:**AI agent 的失败往往先从上下文崩掉开始**,而不是单点执行错误。 - 文章还提到,**Modal、Fireworks、Baseten** 这类美国服务商借助 Nvidia 和 AMD 芯片,能以中国竞争对手约 **1/10** 的成本托管 Kimi K3。 - 由于需求过高,**Kimi K3 目前已暂停新订阅**。 - 最后还收录了一篇分析:为什么一位 OpenAI 高管会认为 **开权重模型会加速技术减速**。
「模型」频道最新
- Qwen3.8 Max Preview 被吐槽思考长达 10 到 30 分钟 — vista8 · 2026-07-21
- Qwen3.8-max-Preview 可直接网页实测,用户称代码能力在变强 — vista8 · 2026-07-21
- 杨植麟十年前博士论文,或成 Kimi K2 万亿参数 MoE 源头 — FinanceYF5 · 2026-07-21
- Gemini 3.5 Pro 仍在延后,Google 可能先推 3.6 Flash — haider1 · 2026-07-21
- 大模型厂商都在“蒸蒸日上”,这梗太对味了 — yangyi · 2026-07-21
- 前沿模型安全翻车:GPT 5.6 Sol 被指为最强大「奖励黑客」 — TAbrodi · 2026-07-21