桃子桃子快讯
返回首页
产品功能

Grok Imagine Image 2.0 强势冲榜,OpenAI 新生图模型疑似曝光

xAI 生图模型 Imagine Image 2.0 在大模型竞技场排名升至第二,主打分层与精准编辑;与此同时,Open…

2026.08.11 · 周二3 分钟阅读

马斯克近期在 X 平台密集推介 xAI 新一代生图模型 Grok Imagine Image 2.0。该模型在 Artificial Analysis 大模型竞技场(LMArena)的文本转图像生成与图像编辑两个赛道均已位列世界第二,成为当前最具竞争力的非 OpenAI 系生图模型之一。与此同时,有网友在 Arena 上发现了 OpenAI 以「mona-lisa-1」代号测试的新版生图模型,生成的图像已能被 OpenAI 验证工具识别出 SynthID 水印,引发关于 GPT-Image 2.5 或 GPT-Image 2.0 Mini 即将推出的猜测。

Imagine Image 2.0:主打分层与精准编辑

与上一版本主要依赖提示词控制不同,Imagine Image 2.0 的核心升级是引入了可交互的精准编辑能力。用户上传一张图片后,Grok 会自动将图片进行分层处理,把主体、背景、文字等元素拆分为独立图层。

以一张维基百科经典表情包为例,模型自动将画面拆分为地球的每一块碎片、举着地球的人物(又细分为「仅人脸」与「包含手势动作」两个图层)等多个部分。点击任一图层右侧的下载按钮,即可将对应主体导出为带透明背景的 PNG 文件。

  • 自动分层:上传即识别主体与背景
  • 图层导出:支持透明背景 PNG
  • 魔棒工具:可手动涂画选区,覆盖未识别区域
  • 多参考编辑:单次最多处理 5 张输入图像并自动拼接
  • 体验地址:https://grok.com/imagine

表情包玩法与审核争议

凭借分层与精确编辑能力,Imagine Image 2.0 在表情包二次创作场景中表现抢眼。例如,可以直接在经典「分心男友」模板上替换不同选区内容,或将会议室白板图中的每个对话框作为独立选区填入新文字,快速生成纵向漫画风格的 Meme 图。

不过,部分用户反馈内容审核较以往更严格。上传蜘蛛侠相关照片时,系统会提示「无法生成可能包含受版权保护的内容」,各类擦边内容的生成也被更强护栏拦截。

OpenAI 新生图模型疑似曝光

近期 LMArena 上线了一款代号为「mona-lisa-1」的匿名模型。随机抽中该模型的网友认为,相比 GPT-Image-2,新版本在真实感与噪声控制上略有提升,整体「AI Slop」感明显下降,在「iPhone 后置摄像头随手拍」这类拟真风格提示词下表现尤为突出。

将 mona-lisa-1 生成的图片上传至 OpenAI 官方验证工具后,系统返回「此内容是由 OpenAI 生成」,并检出 SynthID 水印,证实其出自 OpenAI。该模型的知识截止日期为 2025 年 5 月 22 日,在被要求列举 Anthropic 模型发布记录时,从 Opus 4 之后的时间线出现明显错乱。

综合以上线索,社区推测 mona-lisa-1 可能是 GPT-Image 2.0 Mini 或 OpenAI 即将开源的生图模型,但截至目前 OpenAI 尚未给出官方确认。在 GPT-Image-2 仍稳居生图领域标杆的当下,新版本的具体定位与能力边界仍有待正式发布时揭晓。

信源