基于指令的编辑
用一句话描述更改,而不是选择一个区域。
Black Forest Labs 的编辑模型 FLUX Kontext Pro 和 Kontext Max,旨在应用一项描述的更改,同时让画面其余部分保持不变。
请在桌面端浏览器打开本页开始创作。
FLUX Kontext 的存在,是因为“编辑这张图片”和“生成一张相似的图片”是两项不同的任务,而大多数模型却以相同方式执行它们。
让生成器修改一张照片中的某一处,你通常会得到一张看似合理的新图片——构图被微妙地重绘,你从未提到的细节被悄然重新安排,主体几乎还是同一个人但又不完全一样。Kontext 则是反过来构建的。它的设计目标是应用你指定的更改,并让其他一切都保持可识别的原样。
当某个内容已经存在且只需要让一个特定之处变得不同时,请使用 FLUX Kontext。替换背景、移除物体、更改材质和颜色、调整光线,并将这些更改逐一串联起来,让每一步都可供审查。

FLUX Kontext 是由 Black Forest Labs 开发的图像编辑模型系列,在 Virse 中以两个入口提供:FLUX Kontext Pro 和 FLUX Kontext Max。你提供一张图片和一条书面指令,模型会在画面中已有内容的语境下解读该指令——这也正是其名称的由来。
该模型围绕三大核心优势构建:
两个入口接受相同的输入和相同的指令,区别在于面对高要求编辑时的余量,而不在于可请求完成的任务类型。无需绘制蒙版,无需套索选择区域,也无需管理图层堆栈。

用一句话描述更改,而不是选择一个区域。
你没有提到的任何内容都应保持不变。
Kontext Pro 用于日常工作,Kontext Max 用于复合编辑。
定位通过语言完成:说明对象及其所在位置。
将结果再次输入,把下一项更改作为单独步骤叠加。
为一个入口编写的简短指令可在另一个入口上原样运行。

在 Kontext 指令中,明确哪些内容必须保留并不是凑字数,而是支撑指令的另一半。模型本来就是为了遵守这一点而构建的,这种行为正是编辑模型与接收输入图像的生成器之间的区别。

“左边的汽车”是一种有效的指代方式。不需要绘制蒙版,也不需要勾画路径,这就省去了通常让小幅编辑变得不值得做的那个步骤。

因为每一轮返回的是一张图片,而不是一次重新解读,所以连续执行五个单项更改会产生五个可供审核的状态,而不是不断累积偏移。

对于需要在一系列编辑中保持可识别的人物或产品,这里比反复生成能更好地保持一致,因为没有任何内容在被重新生成。

Kontext Pro 处理日常场景。Kontext Max 则为一次性更改多个相关内容的指令提供更多余量——例如背景和主体光照,或在保留图案的同时更换服装。

大多数模型都针对第一张图进行优化。而这个模型针对的是第十一张图,因为成品素材实际上就是在那一步做出来的。
编辑是迭代式的,而迭代会产生近乎相同的文件。第四版通常是不错的一版,到了第九版,没人能仅凭文件名分辨它们。 Virse 会让整个链条清晰可见。源图、每一次中间处理以及最终图像并排放在同一画布上,因此一次走偏的编辑只会损失一个步骤,而不是整条流程。
每一轮都会按顺序排列,因此可以清楚看出一组操作从哪里开始不再变好。

来自昂贵生成器的差一点成品,在这里修复往往比在那里重新生成更划算,而且修复无需离开画布即可完成。

在 FLUX Kontext 与其他 30 多个图像和视频模型之间切换,无需离开画布,也无需重写简报。

调整开场帧直到合适,然后将其交给 Seedance 2.0、Kling 3.0 或 Veo 3.1。


将主体移到新的背景上,同时保留姿势、比例和光照。

移除一个元素,并用看起来本就该在那里的内容填补空间。

将亚麻变成天鹅绒,或将米色变成森林绿,同时保持形状和阴影不变。

重新布光一个场景,而无需重建它。

将照片转换为绘画,同时让构图完全保持原位。

把一系列单项修正串联成一个成品素材,每一步都可供审核。
导入一张照片、一张生成的图片,或画布上其他位置的一个画面帧。
说明哪些内容应该不同,并指出哪些内容必须完全保持原样。
查看你没有提到的部分,尤其是画面边缘附近。
将结果再次输入以进行下一次编辑,而不是一次性描述所有内容。
一个有用的 FLUX Kontext 提示词通常包含三个要素:
与其这样写
一位身穿红色连衣裙的女性站在带有大理石台面的现代厨房中,自然窗光,专业摄影。
不如这样写
将连衣裙改为红色。保持女性的姿势、面部、头发以及在画面中的位置完全不变,并保持厨房和光线不变。
| 对比维度 | FLUX Kontext Pro | FLUX Kontext Max |
|---|---|---|
| 适用于 | 日常单项更改编辑 | 复合型或高要求编辑 |
| 输入 | 图像加文字指令 | 图像加文字指令 |
| 指令集 | 与 Max 相同 | 与 Pro 相同 |
| 遮罩 | 不需要 | 不需要 |
| 典型用途 | 批量修图、背景替换 | 一次处理多个相关更改 |
| 切换成本 | 简短提示词可在 Max 上原样运行 | 简短提示词可在 Pro 上原样运行 |
“保持其他所有内容不变”可以显著减少偏移。这是使用该模型时最有用的一个习惯。
连续执行三次单项编辑,胜过一条包含三项要求的指令,而且还会留下三个可以回退的位置。
“左边的汽车”是可定位的。“汽车”在画面中有两辆车的那一刻就变得含糊不清。
偏移会出现在画面边缘,也就是你编写指令时视线没有关注的地方。