Grok Build V1.0 被指无新模型:仅 UI 修复,性能落后竞品
eyishazyer · x · 2026-08-07
评论指出,xAI 的 Grok Build V1.0 虽然在社交媒体上引发热议,但实际更新日志仅包含 UI 优化和可靠性修复,底层模型仍是自五月以来沿用的旧版本,并未开源新模型。
在性能方面,其唯一公开的基准成绩 SWE-Bench Verified 70.8% 仍为内部测试结果。第三方实测显示,它在同基准上落后 Claude Opus 4.7 和 GPT-5.5 约 15-18 个百分点。目前 Grok Build 的核心卖点并非更聪明或开源,而是更便宜、更快的体验,且更深层的智能体功能仍需订阅 300 美元/月的 SuperGrok Heavy 才能使用。
「公司和人」频道最新
- 彭博:DeepSeek创始人梁文锋旗下对冲基金上月大跌超20% — firstadopter · 2026-08-07
- Clean Code 作者开源多智能体协调工具 swarm-forge — unclebob · 2026-08-07
- ComfyUI 获 12 万星:匿名开发者以开源挑战 Adobe 创意霸权 — msharmas · 2026-08-07
- 新团队Noiz发布实时交互多模态模型,推理成本降至主流百分之一 — 新智元 · 2026-08-07
- SemiAnalysis:DeepMind已非前沿实验室,人才流失严重 — firstadopter · 2026-08-07
- Anthropic 高管:预计五年内 AI 智能体流量将达人类千倍 — threepointone · 2026-08-07