Hailuo 2.3 Pro Text to Video API

minimax/hailuo-2.3/pro/text-to-video

Hailuo 2.3 Pro Text to Video 将文字提示词转化为电影级原生 1080p 高清视频,具备逼真的物理规律模拟、高动态范围光影呈现与精细的动态表现力。它能精准执行复杂多主体调度、平滑电影运镜与自然运动惯性,在单次固定 6 秒成片中呈现影院级视觉质感与画面细节。

输入
946/5000
输出已就绪
1080p · 6 秒 · 60 积分 = $0.300
继续使用

示例

A restrained cinematic comedy shot of ONE muscular adult amateur boxer reclining in a dental examination chair, wearing a plain dark charcoal T-shirt. Tight close-up of his face, neck and upper chest; his arms and all hands remain OUTSIDE the frame throughout. A single small dental inspection mirror on a thin metal stem enters slowly from the far left edge, held by an unseen dentist. It stays near the image edge and never touches the man. He notices it with only his eyes, swallows once with a visible small throat movement, then tightens his lips and furrows his brow while trying to seem brave. His head remains nearly still. Natural skin texture and subtle coherent facial muscle movement, consistent face, softly blurred clinical room background, fixed camera and soft light. One continuous six-second take, no cuts. No gloves, hands or extra people in frame, no mouth interior, no treatment, no blood, no writing, no logos, no watermark.

A single uninterrupted close-up of a quiet physics experiment on a dark laboratory bench. One large iridescent soap bubble is held between two clean vertical transparent acrylic plates. The right plate moves very slowly toward the left, gently flattening the bubble into a wider oval without bursting it; it then retreats slightly and the elastic soap film rounds out again. A thin wet contact boundary remains visible on each plate. Fine rainbow interference bands flow across the film, realistic transparent reflections and delicate oscillations. Locked camera, black background, soft rectangular laboratory lights; no people or labels. No cuts, no lettering, no logos, no advertising, no watermark.

Hailuo 2.3 Pro Text to Video

Hailuo 2.3 Pro Text to Video 是 MiniMax 旗下的旗舰级文生视频模型,专为高端商业创意与电影级视觉呈现打造。模型输出固定为原生 1080p 全高清分辨率与 6 秒成片时长,呈现出卓越的画质细腻度、严谨的重力流体物理反馈以及敏锐的摄影机运镜调度。支持最长 5,000 字符的丰富提示词输入,内置免费提示词优化器,并以单次 60 积分的透明标准提供稳定高效的生成能力。

为什么选择此模式?

  • 原生 1080p 全高清画质直接渲染输出原生 1080p 分辨率,杜绝后期超分辨率放大引入的模糊与伪影,完美还原皮肤肌理与服饰材质。

  • 高阶物理规律仿真模拟精准解算复杂的运动惯性、水流飞溅、布料飘动与重力相互作用,确保每一帧运动趋势自然可信。

  • 电影级环境光影与材质反光真实呈现体积光散射、镜面高光、柔和阴影过渡以及空气透视效果,展现出色的胶片级视觉质感。

  • 5,000 字符超长提示词解析全面支持多层次复杂场景描写,支持精确指定布光方案、镜头推进轨迹、动作节奏与主体交互细节。

  • 清晰可控的商业级制作计费单次 6 秒 1080p 视频固定消耗 60 积分($0.300),计费简单透明,方便商业项目进行精确的成本预算与核算。

参数说明

参数要求说明
prompt必填

必填字符串,去除首尾空白后不能为空,最多 5,000 个 Unicode 字符。

duration可选

仅支持 6 秒,默认 6 秒。

默认值6
resolution可选

此端点固定为 1080p;省略时使用该值。

默认值1080p
prompt_optimizer可选

可选布尔值;省略时由上游处理,API 不设置默认值。体验区默认关闭,不增加费用。

使用方法

  1. 构思并撰写丰富分镜提示词在 prompt 中详细描写主体外貌、动作演化时序、布光风格与摄影机走位,最多可输入 5,000 个字符。

  2. 确认分辨率与成片时长规格模型固定采用原生 1080p 分辨率与 6 秒成片时长,确保在单次生成中集中释放高密度的画质与动态渲染算力。

  3. 灵活启用提示词优化器若提示词较为凝练,可开启 prompt_optimizer 让模型自动补齐专业电影布光与构图细节,不收取任何额外费用。

  4. 提交异步生成请求向 /api/generate/submit 端点发起 POST 请求并携带 API Key,提交任务后立即获取对应的 task_id。

  5. 轮询状态并获取成品视频通过状态查询端点轮询任务进展,待状态变更为 finished 后从 data.files 读取并下载高清 MP4 视频。

计费说明

1 credit = $0.005。按视频计费,提示词优化不增加费用。

计费项费率说明
1080p / 6s60 credits ($0.300)每个视频

适用场景

  • 高端商业广告与品牌大片以原生 1080p 超清画质与电影级光影,打造极具视觉冲击力的商品特写、特效镜头与品牌宣传片。

  • 影视剧集前期动态预演将剧本文本与导演分镜构思快速转化为动态连续画面,在实拍前直观检验运镜构图与动作表演张力。

  • 游戏概念片与动态过场动画呈现高动态打斗、角色绝招释放与宏大世界观场景,展现强烈的物理动感与环境粒子交互。

  • 高端社交媒体品牌营销为时尚服饰、奢品腕表、高端汽车与前沿科技产品量身定制质感卓越的短视频推广物料。

创作技巧

  • 明确指定专业电影运镜指令:使用'缓慢推近'、'低角度仰拍横移'、'手持跟拍'等专业术语,赋予画面强烈的视听节奏感。
  • 细致描写多光源布光结构:指明'逆光勾勒金色发丝轮廓,侧面柔光补足面部阴影'等布光安排,能深度激发 1080p 的细节表现力。
  • 按照时间先后描写动作演进:在 6 秒时长内按'角色先凝视、随后转身奔跑'的顺序描写动作,使时序逻辑更加严谨平滑。
  • 善用提示词优化器快速激发灵感:在灵感构思初期可开启 prompt_optimizer,让算法自动丰富色彩、镜头与光影质感。
  • 融入具体的材质与微观物理细节:加入'雨水在湿润柏油路面上泛起涟漪'等具象描写,能充分激活高阶物理仿真引擎。

注意事项

  • 固定 6 秒时长设计机制:Hailuo 2.3 Pro Text to Video 专为高密度 6 秒超清镜头设计,传入非 6 的时长参数会被接口直接报错拒绝。
  • 原生 1080p 纯净画质标准:成片直接由生成模型以 1080p 原生分辨率渲染,不经过二次插值放大,画质纯正细腻。
  • 异步任务机制与积分保障:任务采用 task_id 异步轮询获取;提交校验通过时扣除积分,若因异常生成失败将自动全额退还。

Hailuo 2.3 Pro Text to Video API 常见问题

Hailuo 2.3 Pro Text to Video API 是什么?

Hailuo 2.3 Pro Text to Video 是 MiniMax 旗下的旗舰级文本生成视频模型,专为电影级高品质视觉呈现与商业视听创作打造。它能将长达 5,000 字符的自然语言提示词转化为原生 1080p 全高清视频,在固定 6 秒的时长内展现出色的物理动态仿真、体积光影渲染与精准镜头运动。依托 MiniMax 先进的大规模多模态视频生成底座,它精准呈现复杂流体、布料重力与人物动作惯性,同时保持画面高清晰度与帧间连贯性。开发者可以通过 Vidgo REST API 轻松集成,也可以直接在上方体验区进行在线调试。

Hailuo 2.3 Pro Text to Video 的成片是原生 1080p 分辨率吗?

是的,Hailuo 2.3 Pro Text to Video 直接以原生 1080p 全高清规格渲染视频画面,而非通过低分辨率后期算法插值放大,因而具备锐利的边缘细节、真实的景深过渡与丰富的胶片级质感。

为什么 Hailuo 2.3 Pro Text to Video 仅支持 6 秒时长?

Pro 档位模型旨在单次生成中集中释放算力,确保每一帧都达到电影级的物理拟真度与画面精细度,因此专门针对 6 秒高密度镜头进行了针对性架构优化。端点严格限制 duration=6,传入其他数值将导致参数校验失败。

Hailuo 2.3 Pro Text to Video 如何计费?

该端点按视频单次生成固定计费,每个 6 秒 1080p 视频固定消耗 60 积分(约 $0.300,1 积分 = $0.005)。开启提示词优化器(prompt_optimizer)不会产生额外扣费。

Hailuo 2.3 Pro Text to Video 的物理模拟表现如何?

模型融入了强大的真实物理先验知识,能够准确模拟重力加速度、人体运动惯性、液体飞溅与布料风阻褶皱,在剧烈动作或多物体碰撞场景中能够有效避免画面撕裂与不自然的形态坍塌。

在 Hailuo 2.3 Pro Text to Video 中可以使用多长的提示词?

提示词最多支持 5,000 个 Unicode 字符。你可以全面描写画面主体、复杂时序动作、镜头运动路线、灯光色温以及微观环境氛围,模型具备强大的语义拆解与长文本指令遵循能力。

什么时候该选择 Hailuo 2.3 Pro Text to Video 而不是 Standard 模式?

当你需要交付商业广告、影视预演、游戏大片等对原生 1080p 超高清画质与复杂光影有严苛要求的成品镜头时,强烈推荐使用 Pro 模式。若你的项目处于创意验证阶段、需要 10 秒长镜头或注重单片生成成本(6 秒仅需 35 积分),则 Standard 模式更为经济灵活。