Seedream 4 Edit API

bytedance/seedream/v4/edit
1–10 images · 1K/2K/4K · n 1–15

Seedream 4 Edit 结合 1–10 张参考图与文本指令进行免遮罩图像编辑与多图融合。它在精准调整目标元素的同时,严格保留原图人脸五官、核心构图与真实光影。

获取 API 密钥
Input
必填0/5000
必填0/10
可选
可选
可选
Output待生成

生成的图片将在此处显示

预估费用: —
继续使用

示例

edit-01-output.jpg

Combine the three reference images into one natural documentary photograph. Use the elderly bookbinder from image 1 with exactly the same face, wrinkles, eyes, grey beard, navy galabeya, brown leather apron and silver cross. Use only the goatskin cover, gold-and-red interlaced cross, brass bosses and leather ties from image 2; do not copy the white table or the isolated still-life setup. Set the scene in the Cairo workshop from image 3 with its mashrabiya window, wooden press, shelves of quires and the ochre street beyond. The man stands in three-quarter view at the table, pressing the finished cover onto a text block in the wooden press. Relight him and the book with the same warm low afternoon sun from the left and matching lattice shadows, consistent scale and perspective, no text, no watermark.

edit-02-output.jpg

Extend image 1 into a wide 16:9 photograph. Keep the clove basket, the crate, the slatted shutter and the stripe of sun exactly as they are, with the same size, angle and relative position. Naturally expand the scene on both sides and upward: to the left reveal more of the loft with stacked jute sacks of cinnamon bark and a hanging brass scale; to the right open a doorway onto a bright stone stair and a glimpse of a turquoise harbor; above, show the timber rafters and a few swallows on a beam. Seamless continuation of the same late-afternoon light, dust motes and wood grain with no visible seams or borders, no text, no watermark.

edit-03-output.jpg

Redraw image 1 in the exact visual style of image 2. Image 1 defines all content: keep the same high terrace viewpoint and framing, the honeycomb vats, the tanners in the same positions, the drying skins and the surrounding stone walls. Image 2 defines only the style: a cyanotype on textured watercolor paper with a Prussian-blue ground, white or pale-blue highlights, slightly uneven chemical wash and visible paper fibers. Do not copy any ferns, plants or botanical shapes from image 2. No text, no signature, no watermark.

Seedream 4 Edit

Seedream 4 Edit 是字节跳动 Seed 团队研发的多图交互与高保真图像编辑模型。它基于 DiT 与高压缩比 VAE 底座,原生支持传入 1–10 张参考图进行无遮罩局部修改、材质置换与多图融合。模型在深度遵循自然语言指令的同时严格保持主体人脸一致性,最高输出 4K 原生画质,单张仅需 5 积分($0.025)。

为什么选择 Seedream 4 Edit API?

  • 1–10 张参考图融合与素材角色分配原生支持输入 1 至 10 张有序参考图,通过在提示词中指定“图 1 为人物、图 2 为服装”明确分配素材角色,实现高保真多源资产跨场景融合。

  • 免遮罩自然语言交互与微观材质置换无需繁琐的手动绘制蒙版,直接用自然语言描述待调整区域与预期效果,精准实现服装改色、天气置换、光影过渡与复杂材质替换。

  • 主体面容特征与自然环境采光高保真锁定依托深层特征解耦与空间几何推理,在深度编辑背景与动作的同时,严格保留主体面部五官轮廓、发丝细节与真实物理光影反射。

  • 1–15 张批量编辑变体与全画幅自适应延展支持单次请求并发生成多张不同机位、光效或构图的编辑方案,原生适配 8 种画幅与最高 4K 超高清画质,大幅提升方案选型效率。

参数说明

参数要求说明
prompt必填

用 1–5,000 个字符描述修改要求,首尾空白不计入长度。

image_urls必填

按顺序提供 1–10 个 HTTP(S) 参考图 URL,image_urls 数量与 n 之和不超过 15。

size可选

输出画幅比例,默认 1:1。

默认值1:13:44:316:99:163:22:321:9
resolution可选

输出分辨率档位,可选 1K、2K、4K,默认 2K。

默认值2K1K4K
n可选

生成图片数量,取值为整数 1–15,默认 1;image_urls 数量与 n 之和不超过 15。

默认值123456789101112131415

使用教程

  1. 准备并上传参考图像按顺序准备 1–10 张公网可访问的 HTTP(S) 图片或在控制台上传,记录每张素材的顺序与核心元素(如主体、背景、配饰)。

  2. 编写点名编辑指令在 prompt 中清晰点名素材并描述修改需求,例如“将图 1 中的人物置于图 2 的沙滩背景中,保持图 1 人物面部特征与衣着,添加日落暖金光影”。

  3. 配置画幅与批量张数获取合成结果指定输出画幅 size、分辨率 resolution(1K/2K/4K)及生成张数 n(确保图片总数不超过 15),异步提交任务并拉取高保真合成图像。

价格

每张图片 5 credits($0.025),总价按 n 计算:5 × n credits。

用量价格说明
标准生成5 credits/image · $0.025/image5 × n credits · $0.025 × n
n = 1 / 5 / 10 / 145 / 25 / 50 / 70 credits$0.025 / $0.125 / $0.250 / $0.350

适用场景

  • 电商模特与商品跨场景换景将摄影棚拍摄的商品或模特主体与多张外景、生活场景图自然融合,保持模特身形与商品细节的同时自动适配背景光影。

  • 多图特征提取与视觉资产融合将角色形象、服装款式与特定场景道具通过多图输入有机组合,无缝生成符合品牌规范的商业海报与宣传物料。

  • 免遮罩人像精修与微调对人像主体的服装、发型、妆容或背景元素进行微调,无需手工勾勒轮廓即可实现工业级细节替换与面部一致性保护。

  • 创意方案多角度批量发散设定一组参考图后通过 n 参数单次并发输出多种光照、机位或构图备选方案,加速影视前期概念设计与创意比选。

使用技巧

  • 明确分配素材角色:在提示词中建议使用明确指代(如“图 1 为主体人物,图 2 为目标背景,图 3 为参考服装”),避免混淆多张参考图的语义重心。
  • 采用“保留……同时修改……”正向句式:明确告知模型需要冻结保留的要素(如“保留图 1 人物五官面貌与身形”)以及需要替换的细节(如“将背景改为雪山木屋”),减少不必要的画面漂移。
  • 统一多图素材的采光逻辑:当融合多张素材时,在提示词中指定统一的主光源方向与色温(如“统一为正午顶光”或“傍晚暖色侧逆光”),使合成画面更为浑然一体。
  • 注意参考图与输出张数总和上限:务必注意参考图数量与输出张数 n 之和不得超过 15(例如传入 5 张参考图时,n 最大可设为 10)。

注意事项

  • 图像编辑端点输入约束:本端点必须传入 1–10 张公网可访问的 HTTP(S) 图片 URL(支持 PNG/JPEG/WEBP 格式)。如需根据纯文本直接生成画面,请使用 Seedream 4 Text to Image 端点。
  • 素材数量与张数总和限制:单次请求中 image_urls 包含的图片数量加上输出张数 n 的总和不得超过 15,提示词长度需在 1–5,000 个字符之间。
  • 素材输入零附加费与失败全额退款:上传与解析参考图完全免费,费用仅按实际成功生成的图片数量结算(单张 5 credits)。任务若失败将自动全额退还预扣积分。

相关模型

Seedream 4 Edit API 常见问题

Seedream 4 Edit API 是什么?

Seedream 4 Edit 是字节跳动 Seed 团队研发的用于多图融合与高保真图像编辑的模型。它原生支持 1–10 张参考图输入,提供免遮罩局部调整、多图角色分配与跨场景素材融合能力,并支持单次 1–15 张批量生成变体。该模型基于统一的 Diffusion Transformer (DiT) 与高压缩比 VAE 架构,通过深层特征解耦与空间物理推理,在精准响应修改指令的同时严格锁定人物面容特征与自然环境光影。你可以通过 API 编程方式调用或在上方工作区直接上传图片在线体验。

Seedream 4 Edit 最多支持上传多少张参考图片?

Seedream 4 Edit 原生支持传入 1 至 10 张有序参考图(支持 PNG、JPEG 与 WEBP 格式的公网可访问 URL)。在编写提示词时,你可以直接通过“图 1”、“图 2”等明确代词为每张图片分配角色(如主体人物、替换背景或服装样式),实现多源视觉资产的高保真组合。

使用 Seedream 4 Edit 是否需要手动绘制蒙版?

不需要。Seedream 4 Edit 采用先进的免遮罩交互机制,用户无需手动涂抹任何局部选区或上传遮罩图层。模型通过强大的自然语言理解能力,能够根据提示词自动定位待修改区域并完成自然替换与光影衔接。

Seedream 4 Edit 如何保持人物主体的面容一致性?

模型内置深层人脸特征解耦与身份保持模块。在根据指令修改背景环境、发型服饰或动作姿态时,它能够深度锁定主体人物的五官轮廓、皮肤纹理与神态细节,有效避免编辑过程中的身份漂移与面容失真。

Seedream 4 Edit 的参考图数量与输出张数有什么限制?

单次请求中,传入的参考图数量(1–10 张)与生成的图片张数 n(1–15 张)之和不得超过 15。例如,若传入 3 张参考图,则 n 最大可设为 12;若传入 10 张参考图,则 n 最大可设为 5。

Seedream 4 Edit 支持在编辑时修改画面尺寸或比例吗?

支持。你可以在提交编辑请求时自由配置 size 参数选择 8 种画幅比例(如 16:9、9:16、1:1 等),并通过 resolution 参数指定 1K、2K 或 4K 分辨率档位。模型能够自适应扩展或重构画面构图,使生成成品自然适配目标画幅。

Seedream 4 Edit 传入多张参考图会增加计费吗?

不会。Seedream 4 Edit 仅按实际成功生成的图片张数结算,单张固定为 5 credits($0.025),传入 1 张至 10 张参考图完全不产生额外费用。若任务执行失败,系统将自动全额退还预扣积分。