Z-Image Turbo API

alibaba/z-image/turbo

Z-Image Turbo 基于 60 亿参数单流扩散变换器架构与 8 步极速蒸馏算法,将文本提示词或单张参考图转化为高品质视觉图像,具备亚秒级推理响应、精准中英双语文字渲染与真实摄影质感。它在忠实遵循复杂提示词与源图构图光影的同时,为广告海报、概念探索与电商视觉提供兼具极致生成效率与高度可控性的创作体验。

Input

0 / 1000

true
Output待生成

生成的图片将在这里显示

提交费用: 2 credits · $0.010

文生图和图片编辑均为每次 2 credits / $0.010。

示例

The Hidden Geometry of Red Cabbage

An intimate square macro photograph of a freshly cut red cabbage, its cross-section filling almost the entire frame. Intricate tightly folded violet and magenta leaves form an organic maze, separated by delicate ivory veins. A few tiny clear water droplets cling naturally to the cut surface. Soft daylight from the side reveals translucent leaf edges, crisp moist textures and gentle depth between the folds. Slightly oblique camera angle, a coherent botanical structure, sharply resolved central detail and subtle focus falloff at the outer edge. Quiet observational food photography, natural color, no arrangement of products, no packaging, no hands, no labels, no text, no logos and no watermark.

Warm Lights Along the Pool House

Add a few small wall-mounted lamps with a clearly visible warm amber glow beneath the eaves on the front facade of the existing low pool changing-room building. This is a subtle practical lighting addition to the existing neighborhood pool, not a redesign. Keep the daytime blue sky and natural colors. Preserve the principal camera viewpoint and layout: the rectangular swimming pool, tiled edge, dark lane lines, near-right steel ladder, low building on the left and background trees. The newly illuminated warm lights on the facade must be easy to see. Realistic architectural photograph, empty pool area, no people, no advertising, no text or watermark.

Z-Image Turbo

Z-Image Turbo 是由阿里通义(Tongyi-MAI)研发的 60 亿参数(6B)轻量级极速扩散变换器模型,针对高并发、超低延迟的工业级图像生成与敏捷编辑场景进行深度优化。模型采用创新的单流扩散变换器(S3-DiT)底座与高效潜空间蒸馏算法,仅需 8 次函数评估(8 NFEs)即可生成光影自然、纹理细腻的高保真图像,并在英文与中文双语文字渲染、真实人像质感及多尺寸画幅适配方面表现突出。同时提供单图编辑模式,支持传入单个参考图片 URL 进行受控风格变换与微调,采用 Apache 2.0 商业友好开源许可,文生图与编辑统一按每次 2 积分($0.010)透明计费。

为什么选择 Z-Image Turbo

  • 8 步极速推理与亚秒级响应基于单流扩散变换器(S3-DiT)潜空间蒸馏架构,仅需 8 步去噪即可完成高质量图像渲染,在企业级 GPU 上实现亚秒级极速推理。

  • 卓越的中英双语文字排版渲染深度优化双语排版文字生成能力,通过在提示词中为标语、品牌字样与包装文字提供清晰说明,即可在画面中渲染结构清晰、笔画准确的字符。

  • 真实细腻的摄影画质与光影表现擅长处理真实人物肖像皮肤纹理、景深虚化与自然环境光线投射,在各类电商视觉与生活写实场景中展现出媲美主流商业大模型的质感。

  • 文生图与单图精准编辑双模态既支持纯文本生成,也能通过传入单张参考图进行无缝风格转换与场景重构,兼顾全新内容创想与已有视觉资产的二次创作。

  • Apache 2.0 商业友好开源许可与高性价比采用宽松的 Apache 2.0 许可发布,明确支持商业化应用与企业级集成,单次生成统一仅需 2 积分($0.010),大幅降低批量生成门槛。

参数

参数要求说明
prompt必填

描述要生成的图片或编辑要求,长度为 1–1000 个字符,包含至少一个非空白字符。

image_urls可选

提供此参数时执行图片编辑;数组包含 1 个 HTTP(S) 图片 URL。

size文生图必填;编辑可选

输出图片宽高比。文生图时提供;图片编辑时可省略。

1:14:33:416:99:16
enable_safety_checker可选

控制安全检查开关,值为 boolean。

默认值truefalse

使用方法

  1. 选定生成模式与输入参数进行文生图时仅需输入描述提示词并挑选适合的画幅比例;若需基于已有图片进行编辑创作,可提供 1 个公开 HTTP(S) 图片 URL。

  2. 细化提示词与文字说明明确描述画面主体、空间构图、材质细节、光影氛围与艺术风格;若需要呈现特定中英文字符,可在提示词中用双引号标出具体文字内容与载体。

  3. 设置画面尺寸与安全过滤文生图模式下可从 1:1、4:3、3:4、16:9 与 9:16 中选取最符合排版规范的画幅尺寸,并根据生产环境合规需求配置安全检查开关。

  4. 提交任务并获取生成结果携带 API Key 向接口发起 POST 请求提交生成任务,获取返回的 task_id,待任务完成即可直接读取生成好的高清图片 URL。

价格

每次生成 2 credits($0.010),文生图和图片编辑使用相同价格。

用量价格说明
标准生成2 credits / $0.010每次生成

使用场景

  • 电商商品场景图与生活化陈列为各类消费品、美妆数码与家居摆件快速生成多样化商业静物棚拍与自然生活使用场景,降低实景拍摄成本。

  • 营销活动海报与双语宣发物料利用出色的中英双语文字绘制能力,一键生成带有清晰店招、海报标题与促销字样的多画幅社交图文素材。

  • 高频创意脑暴与概念设计推演依托 8 步亚秒级成像速度,在前期创意策划、剧本视觉概念推演与风格预研阶段实现即时反馈与敏捷迭代。

  • 已有图像风格迁移与二次编辑通过传入参考图片 URL 并配合文字指令,快速对已有肖像、静物或摄影素材进行光影调整、背景重构与风格变换。

  • 社交媒体多平台配图批量制作灵活选用 1:1 正方形、16:9 横版宽幅或 9:16 竖版全屏构图,批量生成适配各大主流社交平台的内容配图。

  • 高吞吐低延迟 Web 与 AI 智能体集成将高性价比、极速响应的图像生成服务无缝嵌入至各类实时内容生成平台、聊天对话应用与自动化营销流水线中。

使用技巧

  • 对于画面中需要展示的中英文字符,建议在提示词中使用双引号标明文本内容,并明确指出文字所在的物理载体(例如“印有‘Vidgo’字样的陶瓷咖啡杯”)。
  • 编写提示词时推荐按“主体描述 + 空间环境 + 光线与色彩 + 材质质感”的结构组织语言,帮助模型在极短的推理步数内快速锁定构图核心。
  • 进行单图编辑时,请使用构图清晰的主体参考图,并在提示词中指明需要保留的特征与需要改动的局部元素,以实现稳定受控的变化。
  • 在文生图前先根据最终发布媒介(如横幅 Banner、社交故事或方形卡片)确定 size 画幅比例,使模型的空间透视布局自然贴合构图。
  • 充分利用单次调用仅需 2 积分($0.010)的高性价比优势,在探索复杂创意时进行小批量多轮次提示词微调,迅速收敛至理想视觉效果。

使用说明

  • 提示词参数要求:prompt 为必填项,长度限制为 1–1000 个字符,且必须包含至少一个非空白字符。
  • 单图编辑素材格式:image_urls 参数可选,传入时必须为包含且仅包含 1 个公开有效 HTTP(S) 图片 URL 的数组。
  • 画面画幅支持规则:size 参数支持 1:1、4:3、3:4、16:9 与 9:16;纯文生图时必填,传入 image_urls 进行单图编辑时可省略。
  • 统一透明计费规则:文生图与单图编辑均采用统一费率,单次生成扣除 2 积分($0.010),任务若遇异常中断积分将全额自动返还。

相关模型

Z-Image Turbo API 常见问题

Z-Image Turbo API 是什么?

Z-Image Turbo 是 阿里通义(Tongyi-MAI)用于 文本生成图像与单图编辑 的轻量级高效模型。它根据自然语言提示词或参考图片在 8 步内极速生成高保真图像,具备亚秒级推理响应、精准中英双语文字排版渲染与真实细腻的摄影质感。基于先进的 60 亿参数单流扩散变换器(S3-DiT)架构与潜空间蒸馏技术,它在严格遵循提示词细节与源图构图特征的同时,呈现生动的光影层次与材质质感。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。

Z-Image Turbo 生成一张图片需要几步推理?

Z-Image Turbo 采用深度蒸馏优化,仅需 8 次函数评估(8 NFEs / 8 步推理)即可完成高质量图像生成。相较于传统需要数十步去噪的扩散模型,它的极简推理步数在保障画面清晰度与构图完整性的同时,实现了亚秒级的超快生成响应。

Z-Image Turbo 对中文和英文字符的排版渲染效果如何?

Z-Image Turbo 原生针对中英双语文字渲染进行了深度优化,能够在生成的招牌、包装标签、海报及 UI 原型中绘制出清晰规整的文字内容。在编写提示词时,只需将需要呈现的目标文本使用双引号包裹,并明确其载体位置与字体风格即可。

Z-Image Turbo 支持哪些画面画幅比例?

Z-Image Turbo 原生支持五种主流构图比例:1:1 正方形、4:3 横版标准、3:4 竖版标准、16:9 宽屏横版与 9:16 竖版全屏。在文生图模式下传入对应的 size 字段即可生成适配横幅 Banner、手机壁纸或社交卡片的精确画幅。

Z-Image Turbo 的单图编辑模式如何工作?

在请求的 image_urls 数组中传入单个公开有效的 HTTP(S) 图片 URL,即可开启单图编辑模式。模型将基于源图的整体构图与主体轮廓,结合你在 prompt 中输入的编辑指令,完成局部修改、光影强化、材质替换或艺术风格转换,此时无需额外指定 size 参数。

如何配置 Z-Image Turbo 的安全检查功能?

Z-Image Turbo 提供 enable_safety_checker 布尔参数,默认值为 true,用于自动过滤潜在违规视觉内容。如果企业级私有工作流或特定审核流水线需要自定义过滤规则,可以在提交请求时将该字段显式配置为对应布尔值。

使用 Z-Image Turbo 生成的图片可以用于商业用途吗?

可以用于商业用途。Z-Image Turbo 遵循开源 Apache 2.0 许可证,官方明确许可生成的视觉素材应用于商业广告宣传、电商产品展示、客户端项目交付及企业生产系统。

Z-Image Turbo 在写实摄影与肖像细节方面的表现如何?

Z-Image Turbo 在写实人像皮肤毛孔质感、面部微表情、自然微距光照及商品材质反射方面具有出色还原度。通过在提示词中详细描绘镜头焦段、灯光走向(如柔光棚拍或侧逆光)与景深层次,能够生成媲美高品质商业摄影画质的逼真视觉成品。