始终是同一个人的角色
提供两三张同一张脸的清晰图片——不同角度、光照一致——模型就能在整段片子以及多次生成之间保持这个身份。这正是让一组镜头看起来像同一个项目的关键。
参考图生视频
参考图引导的 AI 视频
添加最多 9 张参考图锁定角色外观、产品细节或美术方向,再描述镜头。用你的真实素材引导生成一致的 AI 视频。
最多使用 9 张参考图来引导角色、产品或视觉风格;生成细节仍可能变化。
模型
参考图片 0/9
参考视频 0/3
MP4 或 MOV,单段 2–15 秒,总时长不超过 15 秒,单个不超过 200MB。需要配置带公开域名的 R2,模型会通过网络拉取该文件。
0/2000
输出数量
声音
有声音
同步生成声音、人声与配乐
生成的视频会显示在这里。描述一个镜头,然后点击生成。
参考图生视频会把源素材加入生成请求。最多添加 9 张参考图和 3 段参考视频,描述想要的镜头,让模型服务商把这些素材作为视觉引导。结果仍然是重新生成的,因此角色、光线、动作和细节都可能变化。
当单靠提示词难以描述主体或视觉风格时,可以使用参考素材。角色设定图、产品图或配色板能为模型服务商提供更多上下文,但它不是后期锁定,也不能保证跨生成的一致性。请保持参考集聚焦,单独描述镜头,并在使用结果前检查生成片段。
一份参考就是一条「保持不变」的指令。下面这三样最常决定素材能不能用。
提供两三张同一张脸的清晰图片——不同角度、光照一致——模型就能在整段片子以及多次生成之间保持这个身份。这正是让一组镜头看起来像同一个项目的关键。
配色、比例、品牌标志位置、材质。文字提示会生成一个看似合理的物体;参考图锁定的才是真实对象——对任何商业用途来说,这一点不容妥协。
配色、颗粒、对比度、年代感、镜头质感。投入一组共享同一种质感的静图,这种质感就会被迁移过去,于是一批片子看起来属于同一个完整系列,而不是一堆风格拼贴。
人的第一反应是把手上所有素材都传上去。忍住——参考之间会互相竞争,九张互相矛盾的图,效果不如三张彼此一致的图。挑那些共享同一套布光逻辑、并且对「你想锁住的东西」毫不含糊的图:锁脸,就用同一个人在相近光线下的两三个角度;锁产品,就用一张干净的主图加一张细节图;锁质感,就用真正共享同一种调色(而不只是「氛围相似」)的静图。把不想被带过去的部分裁掉,因为模型没法知道那个杂乱背景只是偶然入镜。
视频参考和图片参考的工作方式不同,值得刻意区分。图片说的是「东西长什么样」,视频片段说的是「东西怎么动」——节奏、运镜行为、一个动作的韵律。附上一段你欣赏其运动的片段,就能把这个运动套用到它从未拍到过的场景上。注意共享额度:最多 3 段参考视频、总时长不超过 15 秒,所以要挑出承载运动的那一小段,而不是把整条素材传上去。
互相冲突的光线或矛盾的角度会迫使模型去做平均。你的参考之间有多一致,输出就有多一致。
用静图锁定身份与美术方向,用片段借来运镜或动作韵律。把两者放进同一次请求,正是这个工具最强的用法。
模型规格
以下是公开的硬性上限,不是市场话术。每一项都会在扣除积分前由生成器校验:超出限制的任务会被直接拦下,而不是跑到一半才失败。
模型是字节跳动的。FrameAI 补上的是决定它能否真正用于工作的那部分:诚实的上限、诚实的计费,以及一份你有权拿去卖的成片。
文本、最多 9 张参考图、最多 3 段参考视频在同一次生成中被融合,而不是事后拼接。这里没有需要来回切换的「文生视频模式」——你手上有什么素材就丢进去,模型自己去调和它们。
Seedance 2.0 会把脚步声、环境底噪、撞击声和配乐与画面一并写出,并锁定在动作上。大多数模型交给你的是一段静音素材,音效设计还得自己做;这里导出的就是成品。
同一条提示词可以产出 9:16 竖版短视频、16:9 的 YouTube 主片,以及 21:9 的宽银幕片头。分辨率从 480p 到 4K,同一个镜头既能适配宽银幕画幅,也能用于手机。
积分成本由你选的时长、分辨率和画面比例算出,并在点击生成之前就显示出来——而不是之后。如果服务商侧生成失败,预扣的积分会自动退回。
Seedance 2.0 Fast 和 Seedance 2.0 Mini 就是为那二十版没人会看到的草稿准备的。先用 480p 花很少的积分把镜头打个样,再把跑通的那一版用旗舰模型重跑成全分辨率。
付费套餐生成的内容可根据《服务条款》用于商业用途;免费积分生成的内容仅供评估。
参考素材配置一次,这个系列后面的每个镜头都会继承它。
上传最多 9 张图和 3 段片段。把每一份都裁到你想锁住的那个东西上,并剔除在光线或角度上与其他素材打架的那些。
参考素材已经说清了「东西长什么样」。你的提示词应该说的是「发生什么」和「镜头怎么走」——把参考里已有的内容再描述一遍,等于浪费了这条指令。
保持参考集不变,只改提示词,就能产出第二、第三、第四个镜头,而它们都属于同一个世界。
下面每一项在纯文字模型上都会立刻失败,原因相同:必须有东西精确地保持它本来的样子。
出现在十几条片子里的代言人或吉祥物,每次都必须是同一个人。锁定角色参考,才能把「十几个陌生人」变成一个完整系列项目。
几百个商品款号,每一个都需要动态、每一个都必须准确。换掉产品参考、保持提示词与美术方向不变,整个商品库的风格就统一了。
跨集出现的角色和场景,需要的是提示词无法保证的连贯性。参考素材给了一个系列真正的贯穿线。
它是一种接受源图或源视频作为视觉引导的视频生成方式。单次可以添加最多 9 张参考图和 3 段参考视频,然后描述想要生成的镜头。
单次请求最多 9 张图和 3 段视频,参考视频总时长上限 15 秒。但更多并不自动等于更好——彼此矛盾的参考会让结果变差。
没有固定的一致性保证。两三张主体相同、光线相近的清晰参考图,通常能提供更好的引导;极端角度、遮挡或互相冲突的参考素材会增加漂移。
图片参考锁定外观——身份、颜色、材质、美术方向。视频参考贡献运动——运镜行为、节奏、动作韵律。两者可以放在同一次请求里,而这正是该工具最强的用法。
可以。保持参考集固定、只改变镜头提示词,是引导一组相关片段的合理方式;但独立生成仍可能不同,请逐条检查结果。
仅在获得当事人同意的前提下可以。模型无法核验授权,因此责任在你——未经同意生成可识别的真人,不在你的商业授权覆盖范围内。
每个工具都是同一个 Seedance 2.0 模型,只是对准了不同的活儿。你可以随意切换——积分、历史记录和导出文件是共用的。