All models

doubao-seedance-2-0-260128 ★

ByteDanceVideo
0.78–21.11 Credits
Get your API key
doubao-seedance-2-0-260128

面向高清成片的多模态参考视频标准版

doubao-seedance-2-0-260128 是字节跳动 Seedance 2.0 标准版,适合将文字、人物图片和音视频参考组合为短视频。它既能让静态画面动起来,也能以参考素材约束主体、动作与镜头节奏,支持生成声音。需要高清输出、角色参考和短镜头创作时,这是值得优先考虑的版本。

ByteDance模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
文生视频、图生视频、首尾帧生成、多模态参考
输出分辨率
480p、720p、1080p、4k
生成时长
4–15 秒;duration=-1 为自动时长
画幅
16:9、4:3、1:1、3:4、9:16、21:9、adaptive
参考素材
图片最多 9 张;音频、视频各最多 3 条
声音控制
generate_audio 开启有声生成,默认关闭
交付方式
视频链接;支持异步任务、回调及最后一帧返回

以上为本平台对本型号的调用范围,原生能力与各创作模式的素材条件应分别理解。

核心能力

了解 doubao-seedance-2-0-260128 能为你的工作带来什么。

主体参考与场景创作分开控制

使用 reference_image 提供人物或主体,再用文字指定场景、服装、动作和镜头,让参考图承担身份与外观线索,而不是固定整张画面。若希望视频从原图构图开始运动,则改用 first_frame,适合将肖像、产品图或插画转为动态镜头。

用音视频表达动作与节奏

除了图片,还可加入 reference_video 和 reference_audio,为创作提供动作、运镜、声音与节奏线索。文字应说明每份素材需要参考的部分,避免不同素材给出相反要求;需要有声成片时开启 generate_audio,让画面和声音进入同一次生成流程。

从预览画幅到高清交付

标准版提供从 480p 到 4k 的分辨率选择,并覆盖横屏、竖屏、方形和超宽画幅。可先验证主体与动作,再选择更高分辨率制作交付镜头;通过 return_last_frame 获取末帧,也便于预览结尾或为下一段创作准备视觉素材。

适用场景

从具体任务出发,找到模型发挥作用的位置。

产品展示短镜头

输入产品图片与镜头描述,例如缓慢推近、侧向移动或展示材质细节,生成用于广告剪辑的独立片段。需要保留起始布局时使用首帧模式,需要在新场景呈现同一主体时使用参考模式,再按投放位置选择横屏、竖屏或方形画幅。

角色跨场景短片

提供自有或已授权的清晰人物参考图,描述角色在室内、街道或自然环境中的行为,制作同一角色的多个短镜头。参考图负责外观线索,文字负责场景与动作;适合角色概念展示和剧情分镜,交付前逐段检查人物外观与动作是否符合要求。

动作与声音概念验证

将动作示例视频、节奏音频与场景提示组合,探索舞蹈、运动或带环境声的画面表达。先明确要借鉴动作、镜头还是声音,生成短片供创作团队讨论,再下载视频进入剪辑流程,避免把一段参考素材中的全部元素都当作必须复制的目标。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

标准版还是 Fast、Mini

需要 1080p 或 4k 输出时,优先选择本标准版;2.0 Fast 和 Mini 的分辨率范围为 480p、720p,更适合预览与轻量创作。三者均可使用角色和音视频参考,但属于不同调用型号,不应仅替换名称就默认所有参数组合及成片表现完全相同。

高清短镜头还是较长编辑任务

本型号适合 4–15 秒的高清短镜头与多模态参考生成。若需要最长 30 秒、纯音频参考、更多素材,或对已有视频执行编辑与延长,应选择 Seedance 2.5。两者取舍的重点是高清输出与工作流类型,而不是把较新版本理解为所有规格都更高。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 首帧、首尾帧和全模态参考是互斥模式。first_frame、last_frame 不能与各类 reference 标签混用;多模态创作中可用文字说明图片作为起止画面的意图,但需要锁定首尾帧时,应改用专门的首尾帧模式。
  • 参考音频需为 wav 或 mp3,单条 2–15 秒、不超过 15 MB;参考视频需为 mp4 或 mov,单条同样为 2–15 秒。音频和视频各自总时长不能超过 15 秒,准备素材时应先裁剪,避免在处理阶段失败。
  • 本型号用于生成,不应将编辑、延长、联网工具或 mov 输出选择作为它的功能。人物与角色素材须自有或已获授权,照片宜清晰、正脸、无遮挡;参考素材用于引导生成,不代表每个动作和细节都会逐项复刻。

常见问题

解答使用 doubao-seedance-2-0-260128 时的常见疑问。

参考图片与首帧图片有什么区别?

reference_image 用于提供人物或主体线索,场景和动作仍可由文字重新设定;first_frame 则让视频从指定图片开始。想让同一人物进入新环境,选参考图片;想让现有照片构图直接动起来,选首帧,两种标签不要混用。

怎样生成带声音的视频?

将 generate_audio 设为 true,并在提示词中说明需要的声音或环境声,即可请求生成有声视频;该选项默认关闭。若需要参考音频,须使用 audio_url 对象及 reference_audio 标签,并同时提供 reference_image 或 reference_video,不能仅上传参考音频。声音生成与音频参考是不同控制,上传音频不能代替有声生成设置;不使用参考音频时,也可以通过文字描述所需声音。

这个版本能生成 30 秒或延长已有视频吗?

本版本的生成时长为 4–15 秒,也可用 duration=-1 自动决定时长。需要最长 30 秒或已有视频的编辑、延长,请选择 Seedance 2.5;添加 reference_video 是参考生成方式,不等于对原视频执行编辑或续接。

调用时图片地址应该怎样填写?

向 POST /seedance/videos 提交精确 model ID 和 content 数组。图片项使用 image_url 对象,例如其内部包含 url,而不是直接把地址写成字符串;配合 type、role 和文字提示描述用途,分辨率与时长建议使用顶层字段设置。

提交后怎样取得视频成片?

可设置 async=true 获取 task_id 后查询任务,也可提供 callback_url 接收完成通知。取得完成结果后读取 data.video_url 下载视频,不要将提交成功视为成片已经完成;需要结尾图片时,可同时开启 return_last_frame。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 doubao-seedance-2-0-260128 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。