Imagine Image 2.0 能把图片自动分层
直接给结论:比起单纯堆画质,能精准控制局部修改才是生图模型的刚需。最近在折腾 Imagine Image 2.0,发现它最离谱的地方在于能把上传的图片自动“分层”,这让做 Meme 表情包变得极其简单。

以前用 AI 改图基本靠运气,或者得在提示词里反复拉扯,但 Grok 这次搞的交互逻辑很像简易版 PS。你上传一张图,它能自动识别出图里的主体,比如一张维基百科的梗图,它能把碎片、人物、手势动作全部拆成独立的图层。
这种分层能力在实操中非常实用:
- 精准替换: 只要点击右侧边栏识别出的元素(比如衣服颜色、某个 Logo),直接输入提示词就能局部修改,不用担心影响到背景。
- 透明导出: 识别出的图层可以直接下载成透明背景的 PNG,省去了手动抠图的麻烦。
- 多图融合: 支持最多 5 张输入图进行参考编辑,自动拼接的效果比之前好很多。

不过这玩意儿现在护栏设得太死,稍微涉及版权(比如蜘蛛侠)或者稍微有点擦边,立马就提示无法生成,这点确实有点影响发挥。
与此同时,OpenAI 那边似乎也在憋大招。竞技场里出现了一个代号叫 mona-lisa-1 的模型,很多人猜测是 GPT-Image 2.5 或者是某个 Mini 版本。这个新模型最明显的变化是去掉了那种浓浓的“AI 塑料感”,生成的照片自带一种 iPhone 随手拍的噪点和光线不均感,真实度提升了一截。
对比下来,现在的生图赛道很有意思:一个在卷交互编辑(Grok),一个在卷真实感(OpenAI)。对于我们这种经常要快速出图的人来说,能像 Imagine Image 2.0 这样提供分层编辑的工作流,比单纯提高几分清晰度要有价值得多。

事件追踪 · 相关报道
让大模型公司暂停研发真的能让监管跟上吗
5小时前
AI 巨头现在的盈利模式其实是在拿投资人的钱填坑
9小时前
用语音审问 AI 嫌疑人破案这种体验确实比打字有冲击力多了
19小时前
把 AI 实验室的权力推到和政府相当的程度
1天前
拿了菲尔兹奖还预警 AI 会导致人类灭绝
1天前
直接让 ChatGPT 模仿某个具体作家的文风现在开始变难了
1天前
