Gemini Omni Flash Video Edit API

google/gemini-omni-flash/video-edit

Gemini Omni Flash Video Edit 通过自然语言指令修订单条源视频,支持对话式指定修改内容、原生音频更新,以及 720p 至 4K 分辨率输出。它在应用目标修改的同时,保留你指定的主体、运镜连贯与时间连续性。

输入
237/20000
输出
等待运行

生成的视频会显示在这里

填写提示词并添加所需素材,确认设置后点击“运行”。

720p = $1.50 (300 积分)
继续使用

示例

Remove the jogger from the video completely. Keep the fountain, path, trees, benches, sunlight, and the original locked camera unchanged. Seamless background inpainting, no new people or objects. No logos, no readable text, no watermark.

Transform the scene into winter: cover the meadow and the wooden fence with snow, overcast gray sky, gentle falling snowflakes. Keep the camera, fence position, and composition unchanged. No logos, no readable text, no watermark.

Change the time of day to golden dusk: warm orange sunlight, dramatic glowing clouds, the sun low on the horizon reflecting on the water. Keep the sailboat, its position, and the camera unchanged. No logos, no readable text, no watermark.

Gemini Omni Flash Video Edit

Gemini Omni Flash Video Edit 是 Google DeepMind 打造的对话式视频修订模型。上传一个公开源视频 URL,写明要改什么、要留什么,即可生成带同步音频的更新片段。可在 720p、1080p 与 4K 之间选择,配合 16:9 或 9:16 画幅,适合广告变体、对白补拍、服饰或物体替换,以及在不重建整镜的前提下刷新配乐。

为什么选择此端点?

  • 对话式编辑指令用自然语言描述修改——替换物体、调整服饰或刷新音乐——无需基于时间线手动剪辑。

  • 明确的保留与修改控制写清必须保留与必须更新的内容,使修订集中在目标区域或元素。

  • 时间连续性保留在应用创意修改时,保持运镜与场景流动连贯。

  • 原生音频修订随画面更新对白、音乐或环境声,让配乐变化进入同一 MP4。

  • 720p 至 4K 交付档位先用 720p 或 1080p 迭代编辑,修订母带需要更高清晰度时再交付 4K。

  • 横竖屏输出可选选择 16:9 或 9:16,使编辑变体匹配原有分发版式。

参数

参数要求说明
prompt必填

字符串。自然语言编辑指令,覆盖修改与保留内容;去除首尾空格后为 1–20,000 个字符。

video_urls必填

必须提供恰好一个公开可访问的 HTTP(S) 视频 URL;缺失、空数组或多项均拒绝。不接收 duration,此端点不设置源视频时长限制。

resolution可选

字符串。输出清晰度档位;体验区预选 720p。

默认720p1080p4k
aspect_ratio可选

字符串。输出画幅;体验区预选 16:9。

默认16:99:16

如何使用

  1. 上传源视频提供一个公开的 MP4、MOV 或 WebM URL,作为需要修订的素材。

  2. 描述修改与保留内容点明编辑目标与期望变化,并清晰列出要保留的人物、场景或运镜。

  3. 按需补充音频修订线索写明对白、配乐情绪或环境声更新,使声音变化与画面对齐。

  4. 选择分辨率迭代用 720p,更清晰交付用 1080p,高细节母带用 4K。

  5. 选择画面比例按目标分发版式选择 16:9 或 9:16。

  6. 确认费用并运行查看运行按钮费用,完成源视频与提示词后点击运行。

  7. 预览并下载视频任务完成后预览修订后的画面与音频,再选择下载视频保存结果。

价格

按次计费,费用由输出分辨率决定,原生音频包含在结果中。1 积分 = $0.005。配置源片、编辑提示词、分辨率与画幅即可。

用量费率说明
720p / 1080p300 积分默认 720p 为 300 积分($1.50)。
4k400 积分4k 为 400 积分($2.00)。

适用场景

  • 广告创意变体在保留已通过运镜的前提下,替换产品颜色、道具或出镜细节。

  • 对白与主持人补拍在现有说话镜头上刷新台词或语气,无需整场重拍。

  • 配乐与环境声刷新在同一视觉床上替换或增强音乐与音效,匹配新的品牌情绪。

  • 本地化场景适配为区域版本调整服饰、标识或物体,同时保留核心动作。

专业建议

  • 用位置、颜色或服饰定位编辑目标,例如左侧穿蓝夹克的人。
  • 将修改与保留分句书写:把外套改成红色。保留街道背景与原始运镜。
  • 每次提交只设一个主要编辑目标,再用后续轮次细化音频或外观。
  • 写清配乐情绪、进入点与强度,让声音修订落在目标节拍。
  • 需要构图连贯时,让 aspect_ratio 匹配源片版式。

使用说明

  • Gemini Omni Flash Video Edit 需要 prompt,以及恰好包含 1 个公开源视频 URL 的 video_urls。
  • 通过 resolution 与 aspect_ratio 配置交付规格;积分跟随所选分辨率档位。
  • 在提示词中描述对白、音乐或环境声变化;结果包含原生音频。
  • API 提交后保存返回的 task_id,用于查询进度并获取最终媒体地址。

相关模型

Gemini Omni Flash Video Edit API 常见问题

Gemini Omni Flash Video Edit API 是什么?

Gemini Omni Flash Video Edit 是 Google DeepMind 用于对话式视频修订的多模态模型。它通过自然语言指令编辑单条源片,在更新目标元素并同步原生音频的同时,保留你要求继续保留的画面与运镜连贯,并支持 720p 至 4K 输出。基于 Gemini 统一多模态架构,它将修改定位到指定目标,无需从零重建整镜。你可以通过 API 进行程序化调用,也可以在上方体验区直接在线试用。

Gemini Omni Flash Video Edit 如何指定保留区域?

在修改请求后另写保留指令,例如保留街道背景与原始运镜。用位置、颜色或服饰指向主体,模型即可知道哪些内容保持不动。

Gemini Omni Flash Video Edit 如何确定片段时长?

输出长度跟随你提交的源视频。提供 video_urls 与编辑提示词,再选择分辨率与画幅;积分按本页价格说明中的分辨率档位计算。

Gemini Omni Flash Video Edit 能刷新对白与配乐吗?

能。在提示词中描述新的台词、配乐情绪或环境声,声音修订会随画面写入输出 MP4。

Gemini Omni Flash Video Edit 接受哪些源片格式?

video_urls 恰好提交 1 个公开 HTTP(S) 视频 URL,格式为 MP4、MOV 或 WebM。该片段即为待修订素材;完整字段说明见本页参数区。

Gemini Omni Flash Video Edit 何时适合用 4K?

修订母带需要更清晰纹理与光影以便终稿交付时选 4K。日常编辑先用 720p 或 1080p——同一对话式流程、积分更低。

Gemini Omni Flash Video Edit 积分如何计算?

按次按分辨率扣积分:720p 与 1080p 为 300 积分($1.50),4K 为 400 积分($2.00)。详见本页价格说明。