Img2Img 工作流指南

做出真正可控的 Img2Img 转换

从一张图片开始,明确哪些内容必须保持可识别,再描述具体要改变什么。这份实用的 Img2Img 指南把可用生成器、提示词、设置、案例与问题修复方法放在一起,让你下一次生成就能直接使用。

  • 从视觉锚点开始
  • 每次明确一个具体变化
  • 发布前对照检查
原图Img2Img 结果
以彩色几何墙为背景的年轻女性原始肖像
保留人物姿势并转换为精致平面插画风格的 Img2Img 结果
人物和取景保持可识别,同时改变材质、色彩、画面质感与背景表现。

可直接使用的生成器

亲自完成一次 Img2Img 工作流

上传你拥有或获准使用的原图,说明哪些内容要保留、哪些要改变,再选择当前可用的模型和生成设置。工具与指南放在同一页,每学到一个方法都可以立即实践。

图像转换工作台

支持 PNG、JPEG 和 WebP,最大 10 MB

上传图片0 / 1 张图片

试试这些示例

实时模型能力表
尺寸
生成质量
分辨率
输出数量

添加图片和提示词后即可开始

定义与实际限制

什么是 Img2Img?

Img2Img 是图生图生成:现有图片提供视觉起点,提示词和模型设置决定需要改变的内容。

它适合重塑人像风格、完善草图、将产品放入新场景,以及在保留关键视觉特征的同时探索不同方案。

支持的源图格式
3 种格式:PNG、JPEG 和 WebP
最大上传大小
每张源图 10 MB
图片最长边限制
8,192 像素

审核团队Img2Img 产品团队

发布日期更新日期

产品信息关于 Img2Img联系我们

官方参考资料OpenAI 图片生成指南Google Gemini 图片生成指南

可重复执行的方法

Img2Img 如何工作

当你把原图当作视觉证据,而不只是装饰时,Img2Img 最有价值。先给模型清楚的视觉锚点,再指定一个明确变化,最后检查结果是否保留了真正重要的细节。

  1. 01

    上传清晰易读的原图

    选择清楚的照片、产品图、草图、插画或以前的 AI 结果。主体明确、构图有意图的图片,会给模型更可靠的起点。

  2. 02

    说明哪些内容不变

    明确主体、身份、姿势、轮廓、镜头角度、空间布局、Logo 位置,或其他必须保持可识别的视觉锚点。

  3. 03

    描述具体变化

    指定新的场景、材质、灯光、配色、媒介或氛围。一个连贯的方向,比一串互不相关的想法更容易判断效果。

  4. 04

    对照并小步修正

    把结果与原图并排检查。关注身份、人体结构、文字、Logo、比例和产品细节,再只修改造成偏差的那条指令。

控制生成结果

有目的地选择 Img2Img 设置

设置应该服务于当前任务。需要保持构图时先沿用原图比例;优化提示词阶段先生成一张;方向稳定后,再增加质量或生成张数。

可用比例、生成张数、质量等级和积分消耗取决于所选模型。免费模型会展示完整的 GPT Image 2 设置目录;只有实际支持的设置可选,不支持的选项会显示但禁用。

模型

根据需要的变化选择模型。快速免费模型适合验证方向;积分模型可能在风格控制、还原度、速度或输出选项上提供不同能力。

宽高比

需要保留取景时,优先匹配原图比例。只有新裁切本身就是需求时才改变比例,同时预期模型会重新解释画面边缘空间。

生成张数

修正提示词时一次生成一张。指令稳定后,多张输出才更有价值,因为你可以在不改变需求的前提下比较不同结果。

质量与成本

先用低成本预览确认构图和方向。等原图、提示词、模型和比例都能得到正确结果后,再提高质量处理最终细节。

提示词结构

写出容易判断效果的 Img2Img 提示词

有效的 Img2Img 提示词会把视觉锚点和目标变化分开说明。这样结果更容易检查;当模型改得太多或太少时,你也知道应该修改哪一句。

01

保留

说明必须保持可识别的主体、身份、姿势、轮廓、产品形状、房间布局或镜头角度。

02

改变

用具体视觉语言描述新的环境、灯光、材质、服装、配色、媒介或画面处理。

03

风格

增加一个连贯方向,例如杂志摄影、手工黏土、漫画墨线或温暖的建筑渲染。

04

检查

写出需要复核的约束:保持面部身份、保留标签位置、固定窗户位置,或不要改变镜头角度。

产品图片

制作营销场景

保持包装形状、标签位置、Logo 和正面镜头角度可识别。把产品放进明亮的杂志风摄影棚,加入温暖侧光、可触摸的织物和大胆的季节配色。

使用这个提示词结构
人物肖像

改变视觉表现

保持面部、表情、姿势、发型和裁切可识别。把肖像转换成精致的当代动漫插画,使用干净线稿、鲜明色块和自然皮肤细节。

使用这个提示词结构
草图或角色

完善未完成的创意

保留角色轮廓、角、花朵、法杖、服装和正面姿势。把草图发展成温暖、细节丰富的奇幻插画,加入柔和森林光线和手工质感。

使用这个提示词结构

问题排查

修复常见 Img2Img 结果问题

结果不理想时,不要把整段提示词全部重写。先判断偏差来自视觉锚点、目标变化、构图还是细节,再只调整对应部分。

主体已经不再像原图

在提示词开头再次强调视觉锚点。准确描述身份、姿势、轮廓或产品特征;如果所选模型提供变化强度,再适当降低。

结果几乎没有变化

把“更好”“更有创意”等抽象词,替换为可见的灯光、材质、场景、配色或媒介选择。要求一个更明确的方向,而不是多个轻微变化。

构图发生偏移

重新说明镜头角度、裁切、主体位置和空间布局。除非新构图就是目标,否则使用接近原图的宽高比。

手、文字、Logo 或细节错误

把这些视为必须检查的项目,而不是模型一定能保证的结果。明确点名错误细节后重新生成或修订,并在发布前用原尺寸检查品牌资产和文字。

判断可见变化

有价值的 Img2Img 对比应该展示什么

好的案例会同时呈现保留与改变。原图仍然能够解释结果来源,而新图也会在场景、媒介、材质或氛围上产生清晰且有意义的差异。

展示图生图工作台的 Img2Img 品牌预览图

了解 Img2Img 工作台

上传原图,选择模型,说明需要保留和改变的内容。这张品牌预览图展示了用于创作下一张图片的工作台。

通过 Img2Img 把人物照片转换成漫画风格作品的前后对比

从人物照片到插画风格

面部、姿势和取景保持便于对照,同时线条、色彩、纹理与背景语言进入新的视觉风格。

Img2Img 常见问题

生成前需要知道的答案

选择原图、编写提示词和检查 Img2Img 结果时,用户真正需要的实用信息。

Img2Img 是什么意思?

Img2Img 是 image-to-image generation(图生图)的简称。现有图片提供视觉起点,提示词和模型设置引导生成新的结果。原图可以约束主体身份、姿势、形状、构图、色彩或其他视觉证据。

Img2Img 和文生图有什么不同?

文生图只从文字开始;Img2Img 同时使用图片和指令,因此更适合风格转换、概念变体、草图完善、产品场景,以及需要保留部分视觉结构的编辑任务。

Img2Img 提示词应该包含什么?

先说明哪些内容要保留,再描述具体变化,增加一个连贯的风格或处理方式,最后列出需要检查的细节。避免模糊要求和互相冲突的风格。聚焦的提示词更容易与原图比较,也更容易修正。

Img2Img 能完全保留原图吗?

生成模型不能保证完全复制。清晰原图和准确锚点可以提高连续性,但仍应检查身份、人体结构、文字、Logo、比例和产品细节。需要像素级精确保留时,应使用确定性的图片编辑工具。

不登录可以免费使用 Img2Img 生成器吗?

可以。当前免费模型在页面显示的额度和固定支持设置内,无需注册即可使用;不支持的选项会显示但禁用。积分模型需要登录,并会在生成前显示预计积分消耗。

Img2Img 结果可以商用吗?

能否商用取决于你对原图拥有的权利、所选模型条款和最终内容。请使用你拥有或获准使用的图片,检查品牌资产和第三方权利,并在发布前确认适用的模型与产品条款。

从原图开始

把 Img2Img 方法真正用起来

上传一张清晰图片,写下一个聚焦的变化,再根据你选择保留的视觉锚点检查生成结果。

免费试用 Img2Img