专题 · FULL STORY

xAI发布Grok Imagine 2.0及API

xAI于8月8日正式发布图像生成模型Grok Imagine 2.0,凭借精准局部编辑等新能力登顶全球第二。随后该模型相继上线Vercel平台与官方API,全面向开发者开放。

2026-08-08 ~ 2026-08-13 · 5 集 · 62 条

第 1 集 · xAI发布Imagine Image 2.0,登顶全球图像生成与编辑第二(2026-08-08,32 条)

xAI于8月8日正式发布新一代图像生成模型Imagine Image 2.0(即Grok Image 2.0),并作为Grok的Quality Mode在iOS、Android和网页端全平台上线。据LMSYS Chatbot Arena榜单,该模型在文生图(1320分)和图像编辑(1439分)两项能力上均位列全球第二,仅次于OpenAI的GPT Image 2.0。新模型主打实用工作流,在文字渲染、局部编辑和多参考图生成方面实现大幅提升,引发社区热烈反响。

已确认

  • 榜单成绩:据Arena榜单,Imagine Image 2.0 (Low)在文生图与图像编辑两项均位列全球第二,仅次于OpenAI的GPT Image 2.0。
  • 全平台上线:模型已作为全新Quality Mode供用户使用,覆盖Grok的iOS、Android和网页端。
  • 核心功能更新:支持精准的区域局部修改(如悬停选取、Magic wand局部重绘)、多参考图编辑、背景替换以及多比例裁切。
  • 文字渲染能力:多位创作者实测证实,该模型在处理背景文字、复杂排版及极小英文文本渲染时展现出极高准确度,近乎完美克服了以往AI生成图像时文字模糊的痛点。

为什么重要

  • 重塑实用工作流:@tetsuoai与@chaitu等用户实测指出,该模型的局部重绘与精准抠图能力达到了“神级”水平,可直接应用于群照换脸、梗图制作以及电商商品图转摄影大片等实际商业场景。
  • 交互体验升级:@XFreeze提到,用户只需将鼠标悬停在特定区域即可自动识别并修改,这种所见即所得的交互方式极大降低了AI修图门槛。
  • 市场竞争力:@ns123abc等用户反馈,其生成体验在多数日常场景中已能完全替代ChatGPT的图像生成功能,标志着xAI在多模态领域的快速追赶与头部地位的稳固。

还有 12 条相关讨论 →

第 2 集 · Grok Imagine推出精准编辑与分层导出功能(2026-08-08,9 条)

xAI 旗下图像生成工具 Grok Imagine 推出 Precise Edit(精准编辑)与分层编辑功能。用户可通过鼠标悬停对图片特定局部进行即时重绘,且完好保留画面其他元素,甚至可以分离图层并下载透明 PNG 格式文件。马斯克亲自在 X 平台宣布这一更新,实测用户对其展现出的精准控制力表示惊叹。

已确认

  • 功能上线:Grok Imagine 正式推出 Precise Edit(精准编辑)功能,支持鼠标悬停进行局部即时修改,解决了以往 AI 修图容易破坏整体画面的痛点。
  • 分层编辑:新功能支持自动分割生成图像的图层,用户可以下载每个独立图层的透明 PNG 格式,或针对特定图层进行编辑,这对于提取独立元素的设计工作非常实用。
  • 高管背书:马斯克在 X 平台亲自转发并推荐用户尝试该功能,称其图像编辑能力已得到大幅提升。

为什么重要

  • 提升交互效率:该功能使图像编辑变得更加高效,用户无需重新生成整张图片即可完成精细修改,大幅优化了交互体验与修图效率。用户 @XFreeze 实测后对其控制力表示惊叹;设计师也认为 Segments 面板大幅提升了 AI 图像生成的可控性;用户 @yuntatsai 更是称赞其多模态接地(grounding)能力非常出色,能准确理解并编辑图像内容。

第 3 集 · Vercel AI Gateway 独家上线 Grok Imagine 2.0(2026-08-09,2 条)

Vercel 宣布在 AI Gateway 上独家上线 xAI 的图像生成模型 Grok Imagine Image 2.0 预览版。开发者可以通过 npx ai-cli 命令行工具等方式进行调用。该模型一经发布便表现强劲,在图像生成榜单中暂列第二位。

第 4 集 · Grok Imagine 2.0发布,精准编辑登顶全球第二(2026-08-09,12 条)

xAI 正式发布图像生成模型 Grok Imagine 2.0(部分帖子称 Grok Image 2.0),凭借原生集成的精准局部编辑能力引发业界关注。该模型在大模型竞技场(LMSYS)图文生成与编辑类榜单中迅速攀升至全球第二,仅次于 GPT-image-2。多位实测用户指出,它已从单纯的图像生成器进化为实用的创意工具,在 UI 设计、电影海报生成等商业领域展现巨大潜力。

已确认

  • 榜单成绩:Grok Imagine 2.0 在 LMSYS 图文生成与编辑类榜单中位列世界第二,仅次于 GPT-image-2(@eyishazyer、@SimplyAnnisa、@APPSO)。
  • 精准分层与局部编辑:上传图片后,模型支持自动分层(如分离人物面部、手势、背景等),并提供魔棒工具对指针指向区域进行外科手术级修改。用户可直接下载透明背景的主体或一键去除背景(@minchoi、@markk、@APPSO)。
  • 综合创作能力:支持结合多张参考图进行生成、渲染清晰文字、随意调整图像尺寸(@minchoi)。
  • 多模态拓展:支持在同一个平台内将生成的图片直接转化为视频,且图像和视频逼真度极高(@XFreeze)。
  • 官方定调:Grok 官方宣布推出该模型,称其为一次重大升级,旨在为 AI 图像生成领域树立全新标准(@dreamwieber)。

为什么重要

Grok Imagine 2.0 突破了传统 AI 仅能生成整图的限制,将高级分割与交互式局部编辑原生集成。博主 @minchoi 与 @markk 等人在实测中指出,该模型在 UI/UX 首屏视觉设计、电影级海报生成以及超写实截图创作等商业设计领域展现出极高的实用价值。此外,爆料者 @nimaowji 也对其出色表现予以确认,标志着 xAI 在多模态创意工具领域迈出了重要一步。

第 5 集 · Grok Imagine 2.0发布:精准编辑与多图融合,API低价上线(2026-08-11,7 条)

xAI 旗下图像生成工具 Grok Imagine 正式升级至 2.0 版本,并同步上线 API。新版本突破了基础的文生图限制,大幅提升了图像编辑能力,进化为一款全能型创意工具,几乎可以替代传统的 Photoshop 工作流。API 定价极具侵略性,1K 分辨率图像起价低至 0.04 美元,开发者可通过官方 Playground 体验。

已确认

  • 新模型支持融合多达 5 张参考图进行创作,具备文生图和图生图能力。
  • 支持通过单一提示词完成高度精准的局部图像修改,并能一键去除背景、调整尺寸。
  • 具备清晰的文字渲染能力,能生成极具电影质感和高级 UI 元素的图像。
  • API 可处理信息图表、广告素材、游戏资产及 UI/UX 设计等多种复杂场景。

尚未确认

  • 关于模型的具体技术细节(如参数量、训练数据)尚未公布。
  • 官方呼吁社区反馈以改进模型,但具体改进方向未明确。

为什么重要

  • Grok Imagine 2.0 将 AI 图像生成从简单的文生图拓展到了精细的编辑工作流,大幅提升了实用性。这标志着 AI 图像工具正逐步具备替代传统专业设计软件的潜力,配合激进的 API 定价策略,能够满足更复杂的商业创意与开发需求。