大模型

xAI推出Imagine Image2.0图像模型,Grok配套支持5图融合与局部编辑

发布时间:2026年08月10日 10:00:00

xAI推出Imagine Image2.0图像生成模型,作为Grok配套功能网页/移动端可用(API暂未开放)。支持最多5张参考图融合、魔棒局部修改、去背景出透明底、智能扩图(1:2到9:16)与批量模板工作流。Arena测试全球第二,仍存文字错乱等瑕疵。


2026年8月10日,xAI 推出 Imagine Image2.0 图像生成模型,作为 Grok 的配套功能,已在网页与移动端上线(API 暂未开放)。该模型在图像生成与编辑能力上显著增强,瞄准设计、电商、内容创作等高频场景。

核心功能

参考图融合

  • 支持最多5张参考图融合,综合多图风格/构图生成新图
  • 适合风格迁移、角色一致性等创作需求

局部编辑

  • 魔棒分割:智能选区后局部修改,无需重绘整图
  • 去背景:一键抠图输出透明底,便于合成
  • 智能扩图:支持 1:2 到 9:16 多种比例扩展画布

批量工作流

  • 提供模板化批量处理,适配商品调色、头像生成、IP 设计等规模化需求
  • 降低电商/营销团队的出图成本

性能表现

评测位置

  • Arena 测试全球第二
  • 文生图/编辑略低于 GPT-Image-2
  • 以 SpaceXAI 身份参与评测(xAI 关联实体)

现存瑕疵

  • 仍存文字错乱、细节失真等问题
  • 复杂场景需人工二次调整,尚未达到「全自动化」

行业意义

多模态竞赛升温

  • 继 OpenAI GPT-Image、Google Imagen 后,xAI 加入图像模型混战
  • 图像生成成为大模型厂商「标配能力」,补齐 Grok 多模态短板

与同日动态呼应

  • GPT-6 传闻8月发布(代号 Astra),多模态或是重点
  • 豆包、Meoo 等在应用侧推进,模型能力向产品快速转化

商业想象

  • 图像模型可嵌入 X 平台(Twitter)内容生态,形成「生成—发布—传播」闭环
  • API 开放后有望进入电商、广告、游戏等工作流

来源:AITOP100(2026-08-10)