Grok 4.6 登顶 VISTA 基准,将设计稿转应用,单任务成本约 2.38 美元
XFreeze · x · 2026-08-17
Grok 4.6 在 VISTA 基准测试中排名第一,该基准测试 AI 编码智能体能否理解 Figma 设计并构建出可运行的 Web 应用。Grok 4.6 超越了 Claude Fable 5、Opus 5 和 GPT-5.6 Sol,每任务成本约 2.38 美元。这展示了 AI 从设计到代码的完整能力,对开发者有实际意义。
「编程与Agent」频道最新
- 实战:Claude 分析万封客服邮件提取功能需求 — mhmazur · 2026-08-17
- 用“作者即白痴”提示词让 Agent 变身严苛代码审查员 — aronchick · 2026-08-17
- 多代理协作:用 Grok 机器人自动测试并修复 Cursor 编写的游戏 — DeryaTR_ · 2026-08-17
- AI Agent 让编程不再线性,像听3倍速播客 — StewartalsopIII · 2026-08-17
- 实测 Qwen 3.8 27B:默认推理级别过高导致严重过度思考 — Simon Willison · 2026-08-17
- 开源教程:用 VideoSDK 和 SIP 中继构建 AI 电话代理,支持呼入呼出 — tom_doerr · 2026-08-17