从描述走向素材驱动
除了用提示词描述场景,还可以提交参考图像、视频与音频,把外观、动作和节奏要求落实到具体素材。Wan 3 根据 media 识别创作模式,适合已有视觉方向的项目,让文字重点解释哪些元素需要保留、哪些内容需要重新生成。
在选型前明确容量、输入输出与调用方式。
以上数字与控制项为本平台的 wan3.0-video 调用规格,Prime 加速版是不同型号。
了解 wan3.0-video 能为你的工作带来什么。
除了用提示词描述场景,还可以提交参考图像、视频与音频,把外观、动作和节奏要求落实到具体素材。Wan 3 根据 media 识别创作模式,适合已有视觉方向的项目,让文字重点解释哪些元素需要保留、哪些内容需要重新生成。
当开场与收尾画面已经确定,可分别提供 first_frame 和 last_frame,再描述中间的运动与镜头变化。这种方式适合产品揭示、主体移动和转场草稿,让创作围绕明确的起止画面展开;它与参考素材生成是不同模式,需要分别组织请求。
时长、分辨率、画幅和声音可以围绕发布目标组合选择。先用 480P 验证镜头,再以 720P 或 1080P 制作交付版本;横屏、竖屏和方形内容可分别设置画幅。需要声音时显式开启 audio,参考音频则作为素材单独表达。
从具体任务出发,找到模型发挥作用的位置。
输入产品图片与镜头运动参考,在提示词中说明主体、环境、展示顺序及需要保留的视觉特征,生成产品揭示或演示片段。若已设计好开始和结束构图,则改用首尾帧模式,交付可供剪辑与评审的视频素材。
从一段场景描述开始,明确人物动作、环境氛围和机位,选择适合发布渠道的画幅与时长。概念阶段先制作低分辨率草稿,确认方向后调整输出规格,适合将文案创意转成可观看的镜头方案,而不是直接制作完整长片。
将图像、视频或音频素材与创作说明一起提交,用于风格探索、动作参考和节奏预演。应用保存异步 task_id,通过 /wan/tasks 查询结果,再把成功视频及缩略图归档到素材库,衔接人工评审、剪辑与发布流程。
结合任务复杂度、输入材料与预期结果选择。
新项目需要在文本、首尾帧和混合参考之间切换时,wan3.0-video 的统一 media 输入更便于组织素材。已有 Wan 2.6 集成则可继续使用原来的任务型号与 action 等参数。迁移时应重新设计素材结构,不要只替换型号名称,也不要把旧参数直接视为新型号的创作能力。
wan3.0-video 可作为素材驱动创作和后台生成任务的选择;Wan 3.0 Prime 是单独的加速版本,更适合把生成等待时间作为主要考量的项目。选择时结合实际任务测试完成时间与成片效果,不应把 Prime 的速度定位理解为标准版的固定耗时,也不必仅凭版本名称判断画质。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 wan3.0-video 时的常见疑问。
不需要。调用 /wan/videos 时使用 model=wan3.0-video,文字创作由 prompt 表达,首尾帧或参考创作由 media 表达,系统据此识别模式。首尾帧与参考素材应分开提交,不要为了覆盖更多控制条件而混在同一请求里。
指定时长可以使用 2–30 秒整数,适合已有剪辑节奏或明确交付长度的任务。duration=-1 让模型智能选择时长,适合先探索镜头表达的创作。若视频必须配合固定版位或时间线,优先指定秒数,更便于安排后续剪辑。
不是。reference_audio 用于提交音频参考素材,audio 则控制生成视频是否带有声音,默认 false。希望成片包含声音时应显式开启 audio,并在提示词中说明声音目标;不能仅因提交了音频参考就认为已开启声音输出。
设置 async=true 后先保存返回的 task_id,再通过 /wan/tasks 查询任务终态。成功视频会保存到本平台CDN,结果提供视频链接,并可包含尺寸和缩略图信息。工作流应区分提交、处理中与成功交付,而不是只判断请求是否成功。
参考视频按真实输入视频秒数与成功输出视频秒数合计结算,文本、图片和音频输入不增加视频秒数。因此,同样长度的输出,有参考视频与纯文本创作的结算用量可能不同。当前费用查看 Pricing,最终用量以实际 usage 为准。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。