Flux Dev Text to Image API

blackforestlabs/flux/dev
6 sizes · png/jpeg

Flux Dev Text to Image 基于 12B 参数流匹配扩散架构,将自然语言提示词转化为高保真写实图像,具备出色的提示词遵循度、光影层次与原生英文排版文字渲染能力。它在处理人物解剖细节、空间景深与立体构图的同时,能够按照双引号提示词在画面中呈现清晰的标语字样与设计元素。

Input
Output待生成

生成的图片将在这里显示

提交费用: 1 MP × 1 × 4 = 4 credits · $0.020

每个计费 MP 为 4 credits,再乘图片数量;1 credit = $0.005。

示例

Inside the Blue Glacier

A vertical environmental photograph from deep inside a vast natural blue glacier cave. One small adult explorer wearing a burnt-orange parka, dark trousers and a climbing helmet stands in the lower third on solid textured ice, seen from behind in a stable natural stance. A modest warm-white headlamp illuminates a nearby translucent ridge. Towering curved walls of aquamarine ice sweep upward around the explorer, with intricate trapped bubbles and layered striations visible in the foreground; pale daylight enters through a narrow opening far above. Strong sense of human scale, physically plausible ice translucency, controlled blue and amber color contrast, deep spatial perspective, crisp near textures and gentle distant haze, documentary adventure photography, no text, no logos, no watermark.

Cloud Ray over the Dunes

A wide surreal fine-art landscape with a single enormous manta-ray-shaped cloud floating slowly above ochre desert dunes. The ray is made entirely of soft white cloud vapor, with broad gracefully curved wings and a long delicate cloud tail, recognizable as a manta silhouette rather than a solid animal. Late afternoon sunlight gives the vapor luminous edges, while its broad soft shadow falls naturally across the wind-sculpted sand. One tiny solitary traveler in a dark cloak stands on a distant dune ridge at the lower right, emphasizing the vast scale. A pale clear sky, long elegant dune curves, quiet wonder, cinematic depth and carefully balanced negative space, detailed sand ripples in the foreground, no buildings, no vehicles, no typography, no logo, no watermark.

Flux Dev Text to Image

Flux Dev Text to Image 是由 Black Forest Labs 研发的 120 亿参数(12B)流匹配扩散变换器模型,用于从自然语言提示词生成高质量写实图像。模型采用引导蒸馏(Guidance Distillation)技术,在人物解剖细节、光影质感、提示词遵循度以及原生英文字符渲染方面表现均衡。支持 6 种常用预设画幅及 WIDTHxHEIGHT 正整数自定义尺寸,输出 PNG 或 JPEG 格式,按每百万像素 4 积分($0.020/MP)透明计费,任务失败全额自动返还积分。

为什么选择 Flux Dev

  • 原生排版文字渲染能够渲染画面内嵌英文字符、招牌标识与海报标语,只需在提示词中使用英文双引号标注具体字样。

  • 12B 流匹配变换器底座基于 120 亿参数 Flow-Matching 架构与引导蒸馏技术,兼顾细致画质与推理效率。

  • 细致的提示词遵循理解多主体空间关系、材质质感与特定视觉风格,忠实反映提示词构想。

  • 丰富预设与自定义画幅内置 1:1、1:1 HD、4:3、3:4、16:9、9:16 六大画幅,并支持 WIDTHxHEIGHT 正整数自定义像素尺寸。

  • 按百万像素计费与退款保障每百万像素(MP)4 积分($0.020/MP),按实际像素向上取整,任务失败全额自动返还积分。

参数

参数要求说明
prompt必填

图片生成指令,去除首尾空白后至少 1 个字符。

size可选

画布尺寸预设或 WIDTHxHEIGHT 正整数自定义尺寸。

默认值1:11:1 HD4:33:416:99:16WIDTHxHEIGHT
n可选

输出图片数量,取正整数,默认 1。

默认值1
output_format可选

输出图片格式,支持 png 或 jpeg,默认 png。

默认值pngjpeg

使用方法

  1. 构思提示词与排版文字描述主体、环境、光影及视角,若画面中需要出现特定英文字符,请用英文双引号包裹。

  2. 选择画布比例与分辨率从 1:1、16:9、9:16 等预设中选择合适比例,或自定义输入 WIDTHxHEIGHT 正整数像素尺寸。

  3. 配置生成数量与输出格式在 n 参数中指定单次需要生成的图片张数,并选择无损 PNG 或紧凑 JPEG 文件格式。

  4. 提交生成任务并轮询状态通过 API Key 发起 POST 请求,获取 task_id 并轮询查询任务进度,直至状态转为 finished。

  5. 获取并下载生成图片从任务返回结果中的 data.files[].file_url 直接下载生成好的高质量图片。

价格

按提交参数计费,每个计费 MP 为 4 credits($0.020)。每张图片的画布像素数换算为 MP 后向上取整,最低 1 MP,再乘 n;任务失败退还积分。

用量价格说明
单价4 credits/MP · $0.020/MP1 MP = 1,000,000 像素,逐张计算。
1:1 · 4:3 · 3:4 · 16:9 · 9:164 credits/张 · $0.020/张这些预设的单张计费量均为 1 MP。
1:1 HD · 1024x15368 credits/张 · $0.040/张这些尺寸的单张计费量均为 2 MP。
自定义尺寸max(1, ceil(W × H / 1,000,000)) × n × 4 credits使用提交的 size 和 n 计算。

使用场景

  • 商业海报与宣传图文生成包含英文字符标语、品牌氛围与创意构图的营销海报及宣传物料。

  • 概念艺术与场景设计为游戏、影视创作快速探索建筑环境、角色构想与氛围概念图。

  • 电商静物与场景置景通过文本描述生成特定光效与生活化场景下的商品展示背景。

  • 创意方案视觉探索在项目初期快速推演不同艺术流派、构图与色彩方案。

使用技巧

  • 将需要在画面中出现的英文字词用英文双引号包裹,并指出其所在载体,如看板、标签或标牌。
  • 提示词优先采用结构化描述,依次写明主体特征、环境背景、光线质感与整体风格。
  • 优先在提示词编写前选定画面比例,便于模型根据目标宽高比进行合理的空间构图。
  • 通过具体的正向词汇描述希望呈现的材质、色彩与细节,比宽泛的形容词更能获得稳定效果。
  • 自定义画布像素尺寸建议在 1 到 2 百万像素范围内,兼顾画面结构协调性与计费成本。

使用说明

  • 提示词必填约束:prompt 为必填参数,去除首尾空白后至少包含 1 个有效字符。
  • 画布像素计费规则:单张图片像素数(宽 × 高)换算为百万像素(MP)后向上取整,最低按 1 MP 计算。
  • 文件格式选项:output_format 参数支持 png 与 jpeg,省略该参数时默认输出 png。
  • 任务失败自动退还:若生成任务因异常未能成功完成,系统将全额自动返还所扣积分。

相关模型

Flux Dev Text to Image API 常见问题

Flux Dev Text to Image API 是什么?

Flux Dev Text to Image 是 Black Forest Labs 研发的 120 亿参数文本生成图像模型。它根据自然语言提示词生成高质量写实图片,具备良好的提示词遵循度、人物解剖细节处理以及原生英文排版文字渲染能力,支持 6 种预设画幅与自定义尺寸。基于流匹配扩散变换器(Rectified Flow Transformer)与引导蒸馏技术,它在呈现自然光影与质感的同时,能够准确还原双引号内的英文标语文字。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。

Flux Dev Text to Image 支持哪些画面比例和尺寸?

该端点内置 6 种常用画幅预设:1:1(512×512)、1:1 HD(1024×1024)、4:3(1024×768)、3:4(768×1024)、16:9(1024×576)以及 9:16(576×1024)。同时支持传入正整数自定义像素尺寸(如 1024x1536),方便按需匹配不同的设计和展示规格。

Flux Dev Text to Image 如何在画面中渲染指定文字?

在提示词中使用英文双引号将目标英文单词或短语包裹,并指明其展示载体与位置(例如看板标语、招牌文字或包装字样),模型即可在画面中渲染出清晰可读的排版英文字样。

Flux Dev Text to Image 的生成费用是多少?

生成按每个计费百万像素(MP)4 积分($0.020/MP)计费。每张图片像素向上取整为整数 MP,最低 1 MP;预设 1:1、4:3、3:4、16:9 与 9:16 均为 4 积分($0.020)/张,1:1 HD 为 8 积分($0.040)/张。任务若未成功完成,扣减积分全额自动返还。

Flux Dev Text to Image 支持哪些输出图片格式?

该端点支持 png 与 jpeg 两种图片编码格式。通过 output_format 参数进行选择,若请求中省略该字段,系统默认返回无损 png 格式。

Flux Dev Text to Image 支持单次批量生成多张图片吗?

支持。通过将参数 n 设置为正整数,可以在单次请求中批量生成多张图片。总费用按单张费用乘以 n 计算,任务完成后在 data.files 数组中一并返回所有生成的图片链接。

Flux Dev 与 Flux 家族其他模型相比有何特点?

Flux Dev 采用 12B 流匹配变换器底座与引导蒸馏技术,在画质精细度、提示词遵循度与文字渲染上表现均衡,适合高频创意开发;若需要更高保真度与更复杂的编辑能力,可选用旗舰级的 Flux 2 Pro 系列模型。

想要根据已有参考图生成画面时应选择哪个端点?

当已有参考图片需要进行风格转换、画面重构或二次创作时,请选用专门的 Flux Dev Image to Image 端点;当前 Text to Image 端点专注于纯文本提示词直接生成全新图像。