Grok 4.6 登顶 VISTA 基准,将设计稿转应用,单任务成本约 2.38 美元
XFreeze · x · 2026-08-17
Grok 4.6 在 VISTA 基准测试中排名第一,该基准测试 AI 编码智能体能否理解 Figma 设计并构建出可运行的 Web 应用。Grok 4.6 超越了 Claude Fable 5、Opus 5 和 GPT-5.6 Sol,每任务成本约 2.38 美元。这展示了 AI 从设计到代码的完整能力,对开发者有实际意义。
「编程与Agent」频道最新
- Zig 从零写的机器浏览器 Lightpanda 1.0 正式发布 — jedisct1 · 2026-10-02
- dfinke 发布 PowerShell 模块,封装 Perplexity Decisions API — dfinke · 2026-10-02
- gemini-cli 修复点号版 Gemini 3 模型多模态工具输出 400 报错 — bodapatisaikrishna · 2026-10-02
- Cloudflare 推出 Web Search API:给 Agent 一个真正会搜索的浏览器 — Cloudflare Blog · 2026-10-02
- Opus 5.5 让 computer use 好用,擅长网页表单等非 CLI 繁琐任务 — DimitrisPapail · 2026-10-02
- 人类注意力难扛零上下文审查,他重造 IDE 迎战 AI 代码 — arpit_bhayani · 2026-10-02