GPT Image 1.5 Edit API

openai/gpt-image-1.5/edit
image_urls · mask_url

GPT Image 1.5 Edit 结合参考图像与自然语言指令完成精准图像编辑与局部重绘,支持人脸五官与主体特征锁定、可选遮罩精准控制,以及多参考图高维特征融合。它能够在根据指令增删元素、替换背景或调整风格的同时,深度保留原始图像的核心主体结构、光照分布与质感细节。

获取 API 密钥
Input
必填0/1000
必填
可选
可选
可选
Output待生成

生成的图片将在此处显示

预估费用: 2 × 1 = 2 credits · $0.010

每张 2 credits($0.010),按 n 计算总价。

继续使用

示例

edit-03-output.png

Edit only the text on the lower plank: replace "SUMMIT 5 KM" with "SUMMIT CLOSED - SNOW" in the same cream-white hand-brushed capital letters, with the same letter height, stroke texture and slight unevenness, fitted neatly inside the same plank. Leave the upper plank "LAKE TRAIL 2 KM", both arrow shapes, the post, the wood grain, the camera angle and the forest exactly as they are. Then add only a thin layer of fresh snow resting on the top edges of both planks and on top of the post, with a few light snowflakes in the air. No other changes, no extra text, no logos, no watermark.

edit-01-output.png

Turn the creature in this child's crayon drawing into a believable real animal photographed in a sunny backyard garden. Keep its exact design from the drawing: the round purple body, the same large orange spots in the same places, exactly six short stubby legs, two antennae ending in yellow balls, one big eye and the wide crooked smile with two square teeth. Give it realistic soft velvety skin, natural weight and contact shadows on the grass. Eye-level wildlife photography with shallow depth of field, warm afternoon light, a blurred wooden fence and flowers in the background. Friendly and charming, not scary. No paper, no crayon texture, no text, no watermark.

edit-02-output.png

Combine the two reference images. Place the woman from image 1 into the hillside apiary from image 2. She stands beside the second beehive, holding a honeycomb frame she has just lifted out with both gloved hands and inspecting it closely while a few bees fly around. Keep her face, age, silver hair bun, hazel eyes and white beekeeping jacket exactly as in image 1. Keep the painted hive colors, lavender, stone wall, olive trees and hills from image 2. Relight the whole scene to warm golden-hour sunlight coming from the right, with matching shadows on the ground and a soft rim light on her hair, so she looks naturally photographed there. Realistic documentary photograph, three-quarter view, no text, no logos, no watermark.

GPT Image 1.5 Edit

GPT Image 1.5 Edit 是 OpenAI 专为精细化视觉修改与多源素材合成打造的高保真多模态图像编辑模型。它支持传入 1 张或多张参考图片与可选的局部遮罩,通过自然语言指令实现局部修改、风格迁移、主体替换与场景重构。模型具备突出的人物面部特征与身份保持(Identity Preservation)能力,输出规格支持 1024x1024、1024x1536 与 1536x1024,并在重绘区域与原图之间维持高度自然的光影过渡与材质一致性。

为什么选择 GPT Image 1.5 Edit?

  • 强大的人物面容与主体身份保持在换装、换背景与姿态调整等多轮迭代编辑中,深度锁定人物面部轮廓、五官特征与发丝细节,避免传统模型常见的面部变形或身份漂移。

  • 精准遮罩修复与免遮罩指令精修支持通过 mask_url 传入自定义黑白遮罩圈定修改边界,也支持仅通过自然语言清晰描述编辑目标,由模型自动实现发丝级局部精准重绘。

  • 多参考图高维上下文融合支持在 image_urls 数组中按序传入多张参考图片,智能提取不同素材中的人物主体、服装款式、特定道具与场景风格,合成和谐自然的新画面。

  • 自然无缝的环境光影与材质融合编辑区域与原图之间实现深度物理级光影互通,自然模拟反射光、环境阴影与透视景深,杜绝生硬贴图与边界拼接感。

参数说明

参数要求说明
prompt必填

描述要编辑的内容,长度为 1–1,000 个字符,包含至少一个非空白字符。

image_urls必填

至少提供一个公开可访问的 HTTP(S) 图片 URL,可逐项填写或上传图片。

size可选

输出图片的像素尺寸,默认 1024x1024。

默认值1024x10241024x15361536x1024
n可选

输出图片数量,取值为整数 1、2、3、4,默认 1。

默认值1234
mask_url可选

用于指定编辑区域的遮罩图片,填写公开可访问的 HTTP(S) URL 或上传图片。

使用教程

  1. 准备参考图片 URL在 image_urls 数组中填入至少一张公开可访问的 HTTP(S) 参考图片链接,作为编辑的基底图像。

  2. 编写编辑指令与可选遮罩在 prompt 中清晰描述修改要求,例如“将背景换成夜晚海滩”;如需限定重绘区域,可在 mask_url 传入对应的黑白遮罩图。

  3. 选择输出尺寸与数量指定期望的生成尺寸 size(1024x1024、1024x1536 或 1536x1024)与张数 n(1–4),核对预估费用。

  4. 发起异步任务并获取结果向接口提交编辑请求获取 task_id,通过轮询或 callback_url 回调接收最终渲染完成的图片文件。

价格

每张图片 2 credits($0.010),总价按 n 计算。

用量价格说明
标准生成2 credits/image · $0.010/image2 × n credits · $0.010 × n
n = 1 / 2 / 3 / 42 / 4 / 6 / 8 credits$0.010 / $0.020 / $0.030 / $0.040

适用场景

  • 人物写真微调与角色虚拟换装在完整保留人物容貌与气质的前提下,快速更换服装材质、发型发色与配饰道具,满足数字人像资产复用需求。

  • 电商主图换背景与场景化营销提取现有商品主体,无缝迁移至各类高档室内或自然户外场景,省去昂贵繁琐的线下实景棚拍成本。

  • 画面瑕疵修复与干扰元素擦除结合局部遮罩或精确提示词,轻松移除画面中突兀的杂物、路人或水印瑕疵,自然重绘补充底层纹理。

  • 品牌视觉风格迁移与多图合成结合多张品牌参考物料,将特定插画、复古胶片或赛博朋克艺术风格应用至目标图片中,形成统一视觉矩阵。

使用技巧

  • 编写编辑提示词时,建议采用“修改指定区域 + 明确保留其余元素”的句式结构,如“将人物手中的咖啡杯替换为一本书,保持人物手势、面容与背景完全不变”。
  • 进行局部替换或精准修复时,搭配使用分辨率与原图严格匹配的黑白遮罩(白色代表编辑区域,黑色代表保留区域),能获得极高边界准确性。
  • 传入多张图片进行融合时,建议在 prompt 中通过“图 1 的人物”与“图 2 的背景”等明确指代来源,引导模型合理分配视觉特征。
  • 保持面部特征一致时,尽量提供光照清晰、无严重遮挡的正面或微侧面高质量原图,能让模型更好提取并延续五官细节。

注意事项

  • image_urls 为必填参数,支持传入一个或多个公开可访问的 HTTP(S) 参考图片链接作为编辑底图。
  • prompt 为必填参数,支持 1 至 1,000 个字符,清晰说明修改目标与需要保持不变的元素。
  • mask_url 为可选参数,支持传入黑白遮罩图片为局部重绘提供精确的空间几何约束。
  • size 支持 1024x1024、1024x1536 与 1536x1024 三种规格,单次可通过 n 参数生成 1 至 4 张独立编辑变体,按张计费。

相关模型

GPT Image 1.5 Edit API 常见问题

GPT Image 1.5 Edit API 是什么?

GPT Image 1.5 Edit 是 OpenAI 用于图像精准编辑与局部重绘的模型。它结合公开可访问的参考图片、自然语言修改指令与可选遮罩,在 1024x1024、1024x1536 或 1536x1024 分辨率下生成精细修改后的高保真图像,具备卓越的人物面容身份保持与多图特征融合能力。基于 OpenAI 先进的多模态图像理解与重绘架构,它在实现局部增删、背景替换或风格变换的同时,深度保留非编辑区域的原始构图、物理光照与纹理质感。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。

GPT Image 1.5 Edit 在进行人像修改时如何保持面部特征一致?

模型内置专门的面部与主体一致性特征提取机制。在提示词中明确“保持人物身份和面部特征不变”,模型会在多模态潜空间锁定面部关键骨骼与五官轮廓,仅根据指令微调发型、妆容、表情或服饰,有效防止面部失真。

GPT Image 1.5 Edit 进行局部重绘时必须上传遮罩吗?

不是必须的。模型支持纯文本驱动的自然语言编辑,只需在 prompt 中清晰指出需要改变的对象与保持不变的区域即可;若搭配 mask_url 上传遮罩图片,则能为编辑范围提供更强烈的空间几何引导。

GPT Image 1.5 Edit 支持传入多张参考图片进行融合吗?

支持。你可以在 image_urls 数组中传入多个公开图像 URL,模型能够综合提取不同素材中的主体对象、风格调色与特定道具,并在提示词的指导下将它们重构为具有连贯逻辑的全新图像。

GPT Image 1.5 Edit 上传参考图片和遮罩有额外收费吗?

没有。GPT Image 1.5 Edit 与文生图端点费率完全相同,不收取任何输入图像或遮罩的额外处理费用。费用仅根据输出图片数量按 2 积分/张($0.010/张)计算,任务失败全额自动返还。

GPT Image 1.5 Edit 支持哪些输出画幅规格?

GPT Image 1.5 Edit 原生支持三种标准输出规格:1024x1024(1:1 正方形,默认)、1024x1536(2:3 纵向竖版)以及 1536x1024(3:2 横向宽幅)。模型在重绘与编辑时会严格维持相应比例下的空间构图与透视连贯性。

GPT Image 1.5 Edit 单次能够生成多张编辑变体吗?

可以。单次 API 调用支持通过 n 参数指定生成 1 至 4 张独立编辑变体(默认为 1)。多张变体在同一次请求中并行处理,便于在同一组参考图与修改指令下快速比选不同的调整细节与生成风格。

编写 GPT Image 1.5 Edit 编辑提示词有哪些实用建议?

建议遵循“动作指令 + 目标对象 + 保留约束”的原则,例如“将背景替换为现代办公室,保持前景人物的姿势、衣着和面部完全不变”。清晰说明哪些元素需要改变、哪些需要保留,有助于获得最为精准的重绘效果。