虎嗅

马斯克的新生图模型,让我笑了一整晚

核心内容总结

近期AI生图领域有两大热点:一是马斯克推广的Imagine Image 2.0凭借“精准分层编辑+表情包”功能出圈,在生图和编辑领域位列世界第二,但因审核过严遭用户吐槽;二是OpenAI悄悄测试GPT-Image 2的新版本(代号mona-lisa-1),生成图的真实感显著提升且带有OpenAI专属水印,但知识更新截止到2025年5月,疑似简化版或开源模型。

详细拆解解读

1. Imagine Image 2.0:靠“接地气功能”逆袭的黑马

这个模型的出圈秘诀是精准分层编辑——把图片拆成多个独立图层(比如一张图里的衣服、人脸、背景各成一层),普通人不用学PS就能直接改:

  • 改表情包:比如经典“分心男友”图,你可以单独把女友换成奶茶、把男友的视线改成看游戏;会议室白板的气泡框,点一下就能直接输入文字,秒变纵向漫画。
  • 导出透明背景:选中图里的主体(比如一只猫),点下载就能拿到无背景的图,直接用来做表情包或海报。
  • 多图融合:一次上传5张图,模型能自动拼接成一张(比如把风景、人物、文字拼在一起)。

这些功能让它在生图和编辑领域都排到世界第二,马斯克还在X上疯狂安利。

2. Imagine的双刃剑:好用但“管太严”

优点很明显:交互比GPT-Image 2友好——GPT-Image 2全靠写提示词控制(比如“把背景改成蓝色”),而Imagine直接点图层改,像玩拼图一样简单。

但缺点也扎心:审核机制“较真到离谱”——上传蜘蛛侠图会提示“版权保护”不让生成,擦边图更是直接拦死,有网友吐槽“想做个有趣的图都被卡”。

3. OpenAI新模型:更真实但“知识断更”

网友发现OpenAI在测试mona-lisa-1,它的亮点是:

  • 真实感拉满:原来GPT-Image 2中度模式生成的广告牌一看就是AI做的(假假的),新模型生成的像手机随手拍的(有运动模糊、光线不均,反而更真实)。
  • 带“身份证”:用OpenAI的验证工具查,图里有SynthID水印(相当于AI图的“防伪标签”,证明是OpenAI生成的)。

但它有个小bug:知识只更新到2025年5月22日——比如让它画Anthropic公司的模型时间线,2025年5月之后的内容就乱了。有人猜它是GPT-Image 2的简化版(Mini),或者OpenAI准备开源的模型。

4. AI生图竞争:从“比好看”到“比实用”

以前生图模型比谁生成的图更清晰、更精美(比如Midjourney的中国仙境图),现在风向变了:

  • 拼交互:像Imagine的分层编辑,让普通人也能轻松改图;
  • 拼真实感:OpenAI新模型追求“手机快照感”,避免AI特有的“假感”;
  • 拼接地气:能做表情包、改会议图,解决用户的实际需求。

用户不再满足“看个热闹”,更想要“能用得上”的功能。

5. 未来期待:AI生图还能玩出啥新花样?

现在大家看腻了千篇一律的信息图,接下来还希望AI生图能做到:

  • 一致性:生成一系列图时,人物的样子、风格不变(比如漫画连载里的主角不“变脸”);
  • 密集文字:生成带大量文字的信息图时,文字清晰不模糊;
  • 创意美学:像Midjourney那样,能生成震撼的艺术风格图(比如中国风、赛博朋克);
  • 更灵活的编辑:比如能把不同图的元素自由组合,或者让AI自动补全图里的缺失部分。

AI生图已经从“炫技”阶段,慢慢走向“实用化”,未来会更贴近普通人的日常需求。