深入图像2.0:精准编辑优于新颖生成
Grok Imagine图像2.0的设计更像是一款设计工具,而非玩具。‘魔法棒’是一种定向编辑界面:点击图像中的一个区域,仅该区域发生变化,而其余构图保持不变[1]——这与倾向于重绘整个画面并导致其他区域出现不必要偏移的生成式编辑器形成了有意义的转变。结合‘分割’功能(用于精确选择编辑区域)和‘智能调整大小’功能(可在大约1:2至2:1的宽高比范围内——涵盖9:16、正方形和横屏——重新排布已批准的图像,而无需裁剪或拉伸[1]),这套工具集面向需要将单一素材复用于多种格式的用户——例如社交媒体帖子、横幅广告、产品缩略图——而无需每次都从头开始重新生成。
多参考编辑进一步推进了这一逻辑:用户无需手动拼接多个源图像,而是可将最多五张参考图像输入单次生成,由模型自动融合[2]。结合背景移除以实现透明导出,以及为产品拍摄、肖像、电商照片、图标、游戏素材和商品设计等常见任务预设的一系列工作流模板[1],xAI将此次发布定位在‘实际工作’而非一次性图像新奇性上——这一定位选择使图像2.0与早期更侧重于在X平台上进行休闲生成的Aurora时代Grok Imagine区分开来。
对此次发布的实测报道发现,模板库比xAI自身材料所暗示的更为丰富——评测人员统计出15个现成模板,涵盖产品换色、海报创建与编辑、‘再想象’混音模式、照片拼贴、活动图像、背景移除、电商与用户生成内容(UGC)产品照片、专业肖像、图标、角色姿势、表情符号、商品和产品植入。同样有报道指出了一项专为视频创作者设计的功能:构建一个可重复使用的角色、地点和物体的统一‘世界’,随后可将其带入下游AI视频生成中,从而将图像2.0的编辑精度扩展到静态图像之外。实际使用该功能的用户反应迅速且积极——跟踪发布的账号描述了指令遵循能力和排版能力的重大提升,埃隆·马斯克也直接发声,称‘Grok Imagine图像编辑得到了极大改进’,这一背书与功能集相符,而非相悖。



