把镜头意图写成可执行描述
从文字开始时,可在提示词中交代主体、场景、动作、镜头运动和光线气氛,生成用于审阅的视频画面。相比只写一个主题,更适合把拍摄意图表达完整:例如主体缓慢转身、镜头向前推进、环境保持柔和逆光,让创意讨论落到具体镜头。
在选型前明确容量、输入输出与调用方式。
上述规格为本平台的 omni-flash 调用范围;Gemini Omni 不同原生版本的扩展功能需分别区分。
了解 omni-flash 能为你的工作带来什么。
从文字开始时,可在提示词中交代主体、场景、动作、镜头运动和光线气氛,生成用于审阅的视频画面。相比只写一个主题,更适合把拍摄意图表达完整:例如主体缓慢转身、镜头向前推进、环境保持柔和逆光,让创意讨论落到具体镜头。
通过参考图片引导生成,可从产品照片、人物图片或插画继续制作动态画面。图片提供视觉依据,文字说明运动方向、场景关系与期望风格。适合已有设计素材、但尚未形成视频镜头的制作阶段;应写清图片承担的是主体参考还是整体视觉参考。
已有视频也能作为创作起点,配合参考图和编辑指令生成新视频。可要求改变季节、调整场景风格或增删画面元素,并明确哪些构图关系需要保留。这样的工作方式适合围绕同一素材做创意变体,而不是每次重新描述整个场景。
从具体任务出发,找到模型发挥作用的位置。
输入已选定的产品图片,说明产品动作、镜头方向与背景氛围,制作可供营销团队审阅的展示视频。横屏适合页面或演示画面,竖屏适合竖向内容布局。交付后重点检查产品轮廓、构图与动作是否符合创意,再决定是否进入正式剪辑。
输入已有场景视频与参考图片,用文字要求更换天气、季节或视觉风格,同时列出需要保留的位置关系。例如将晴天海滩改为冬日场景,但保留树木与船只布局。产出可用于比较不同创意方向的新版本,减少从空白画面重新构思的工作。
应用后端提交提示词、画幅和素材链接,以 async 创建任务,保存 task_id 后查询结果,或通过 callback_url 接收完成通知。取得成功状态与视频链接后下载归档,再交给审阅或剪辑流程,适合不希望持续保持生成请求连接的制作应用。
结合任务复杂度、输入材料与预期结果选择。
只有创意文字时选择文生视频;已经确定主体外观或视觉方向时加入图片参考;希望修改既有镜头时使用视频与图片组合。omni-flash 的选择价值在于让这些素材形态进入同一视频流程。编辑任务尤其应把“要改变什么”和“要保留什么”分别写清,而不是只提交笼统的风格词。
omni-flash 用于视频生成和编辑,不应与 Gemini Flash 的文本对话型号混用。Gemini Omni 1.1 Flash 也有独立的原生版本名称,不能因为名称接近就把首尾帧或延长控制直接套用到本入口。若目标是现有素材引导和场景改写,可选择这里的工作流;若依赖特定版本功能,应按版本分别选型。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 omni-flash 时的常见疑问。
不是。这里的 omni-flash 面向视频创作,通过 POST /gemini/videos 提交文字和可选素材,交付视频结果。它不是在对话接口中返回普通文本答案的 Gemini Flash 型号;开发时应按视频任务组织输入、状态查询与结果保存。
可以通过 image_urls 提交图片链接,并同时填写必需的 prompt。建议在文字中写清主体怎么运动、镜头如何移动以及希望保持的视觉特征。图片用于引导生成,不要仅写“动起来”,否则很难表达你真正需要的镜头效果。
需要在 video_urls 提交一个视频链接,并在 image_urls 中提供至少一张参考图片,再用 prompt 描述修改目标。可以围绕风格、场景或画面元素提出要求,也应说明需要保留的布局。只传视频而不传图片不符合该工作流的输入要求。
可以。aspect_ratio 支持 16:9 与 9:16,resolution 支持 720p 与 1080p,默认分别为 16:9 和 720p。建议在创作前确定交付画幅,尤其是主体位置与镜头移动方向,避免生成后再裁切导致构图偏离原本意图。
设置 async 为 true 后保存返回的 task_id,向 /gemini/tasks 提交以该值作为 id 的查询请求;也可设置 callback_url 接收完成通知。任务成功后读取结果中的 video_url 并下载保存,仍为 pending 时继续等待,失败时检查错误信息。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。