Grok4.5发布与CLI安全风波
APPSO · wechat · 2026-07-15
Grok 4.5 发布与能力实测
文章称 Grok 4.5 已向所有用户开放,内部评价接近 Opus 级别,主打更快、更便宜。作者提到它目前是 1.5T 参数,计划在本月底训练并发布 2T 版本;同时马斯克还表示会尽快把上下文扩到 1M。
代码与 Agent 场景
测试里,Grok 4.5 在编程、智能体和知识工作上比前代更强,能在一些开发任务中接近 Claude / GPT 的表现。文中举了几个例子:
- 用 Three.js 做 3D 网页场景,结果比 GPT-5.6 更真实,但整体仍像半成品,离 Fable5 还有差距
- 生成深度研究网页时,报告内容较完整,但交互较弱
- 在 CLI 里做 Word 转 Markdown 的 macOS App,几分钟内完成并可运行
- 尝试复刻 PDF Expert,能做出批注、高亮、框选等基础功能
安全与信任问题
文章后半部分重点讲了两类风险:
- 模型越狱:有研究员在发布后数小时内展示了绕过防御、输出高危管制知识的截图,说明大上下文与多轮对话会放大对抗性提示词攻击面。
- GrokCLI 静默上传本地文件:安全审计显示,CLI 在本地初始化和任务执行时会把当前仓库打包上传,甚至越界扫描主目录,可能带走 Claude Code 配置、Skill、API key 等敏感数据。官方回应提到 ZDR 和 /privacy 选项,但评论区认为问题核心是工具本身的上传逻辑。
结论
作者认为,AI 竞争已经从“比模型”变成“比谁更值得把电脑交给它”。模型能力在变强,但围绕权限、透明度和本地信任的工程问题也在同步放大。
所属事件:Grok 4.5 聚焦编程与代理工作流(12 条相关)→
「编程与Agent」频道最新
- 开发者发问:现在还该用 LangChain 还是自建 agent 框架? — curious_vii · 2026-09-03
- 推理工程吃香:vLLM/SGLang 搭副本加缓存路由核心配方 — GabGarrett · 2026-09-03
- 开发者误打误撞用 Fable 5.1 搭出一座「智能体工厂」 — 0xkarasy · 2026-09-03
- 微软新法:Foundry 智能体可经 Fabric IQ 调用 Fabric 数据智能体 — adnan_hashmi · 2026-09-03
- Databricks 在 VLDB 2026 主推 agent 原生数据基础设施 Lakebase — matei_zaharia · 2026-09-03
- doodlestein 沉淀数月经验,发布 Web 应用综合审查 Skill — doodlestein · 2026-09-03