The Batch:开源 GLM-5.3 漏洞利用能力逼近 Claude,12% vs 14%
DeepLearningAI · x · 2026-10-02
DeepLearningAI 本周 The Batch:Andrew 的信聚焦模型安全能力——开源权重模型 GLM-5.3 在漏洞利用任务上以 12% 对 14% 的成绩接近 Claude Mythos,开源与闭源前沿模型的攻防能力差距正在缩小。本期还涵盖:小米新的开源权重领跑模型、Gemini 3.8 Live、DeepSeek-V4.1-Flash 与 AREX agents。
「模型」频道最新
- 本地 AI 社区焦虑:越依赖 Claude 与 GPT 越壮大闭源巨头 — takoulseum · 2026-10-02
- 开发者把生产系统从 GPT-5.4 换到 GLM:更快更便宜更可靠 — ivan_bezdomny · 2026-10-02
- Gemini 4 Argon 玩 3D 游戏生成,已能与 Claude 顶尖模型掰手腕 — 141_1337 · 2026-10-02
- 「画出人类史上最大骗局」:Opus 5.5 的答卷引热议 — zealcaiden · 2026-10-02
- 开发者晒 Grok API 用量:累计 60 亿 token、几乎零宕机 — Daniel_Farinax · 2026-10-02
- AstaBrief 实测:比 Claude 驱动模式快 3.5 倍,引用质量相当 — allen_ai · 2026-10-02