图片锁住外观
颜色、形状、材质、品牌标志位置、一个人的脸——画面里有什么,就还是什么。这正是「上传」而不是「描述」的全部理由,也是通用视频模型在商业项目上翻车的地方。
图生视频
图生视频 AI
上传任意照片、插画或产品图,交给 Seedance 2.0 赋予运动。运镜、光线变化与同步音频,一句提示词全搞定。
锁定开场画面;当前工作流要求时再指定收尾画面,中间的运动由模型补全。
模型
锁定开场画面;当前工作流要求时再指定收尾画面,中间的运动由模型补全。
0/2000
输出数量
声音
有声音
同步生成声音、人声与配乐
生成的视频会显示在这里。描述一个镜头,然后点击生成。
图生视频解决了纯文字解决不了的问题:把一个「具体的、真实存在的东西」放到画面里。上传你的产品、作品、场地或角色,描述接下来该发生什么,Seedance 2.0 就会让这一帧动起来——在保留主体本身的同时,加上运动、运镜和同步声音。
在商业价值上,这一点比任何其他模式都重要。文字提示很乐意帮你造一双看起来合理的球鞋,但它造不出「你的」那双球鞋——你的配色、你的品牌标志位置。把生成锚定在上传的图像上,才能让你真正要卖的那个东西在每一帧里都保持准确。单次请求可附最多 9 张参考图,所以产品、人脸和配色可以同时被锁住,分辨率最高 4K。
关键是理解这个分工:图片提供身份,文字提供一切会动的东西。
颜色、形状、材质、品牌标志位置、一个人的脸——画面里有什么,就还是什么。这正是「上传」而不是「描述」的全部理由,也是通用视频模型在商业项目上翻车的地方。
描述发生了什么、镜头怎么走:绕着产品环绕一圈、风吹过头发、从阴影中缓慢显现。静图变成了镜头,但没有变成另一个物体。
一次附上多份参考——产品、模特、环境——Seedance 2.0 会把它们调和成一条连贯的成片,而不是在它们之间来回切镜。
输入质量决定上限。一张清晰、布光干净、分辨率够用的图,能给模型关于形体和材质的明确信息;而一张小、糊或压缩严重的图只会让它去猜,而猜测会在片子里表现为逐渐漂移。构图同样重要——在主体周围留一点余量,因为一张紧贴边缘裁切的照片会让镜头无处可动,只能去编造画面里从未存在过的部分。
然后,只要求这张图撑得住的运动。正面拍摄的照片能很好地承受推近或轻微环绕;但要求镜头完全绕到主体背后,就是在让模型编造一个它从没见过的背面,而离原始视点越远,结果就越不可靠。产品类工作最稳的套路是:小幅度运镜 + 环境运动——蒸汽、光线变化、织物落定——观感上像很贵的实拍,同时主体稳如磐石。
对焦清晰、布光干净、主体没有紧贴画面边缘裁切、没有明显 JPEG 压缩噪点,也没有水印或叠加文字。
推近、轻微环绕、视差、变焦跟焦,再加上氛围元素。极端视角变化和 360 度绕转,是在让模型编造它看不见的几何结构。
模型规格
以下是公开的硬性上限,不是市场话术。每一项都会在扣除积分前由生成器校验:超出限制的任务会被直接拦下,而不是跑到一半才失败。
模型是字节跳动的。FrameAI 补上的是决定它能否真正用于工作的那部分:诚实的上限、诚实的计费,以及一份你有权拿去卖的成片。
文本、最多 9 张参考图、最多 3 段参考视频在同一次生成中被融合,而不是事后拼接。这里没有需要来回切换的「文生视频模式」——你手上有什么素材就丢进去,模型自己去调和它们。
Seedance 2.0 会把脚步声、环境底噪、撞击声和配乐与画面一并写出,并锁定在动作上。大多数模型交给你的是一段静音素材,音效设计还得自己做;这里导出的就是成品。
同一条提示词可以产出 9:16 竖版短视频、16:9 的 YouTube 主片,以及 21:9 的宽银幕片头。分辨率从 480p 到 4K,同一个镜头既能适配宽银幕画幅,也能用于手机。
积分成本由你选的时长、分辨率和画面比例算出,并在点击生成之前就显示出来——而不是之后。如果服务商侧生成失败,预扣的积分会自动退回。
Seedance 2.0 Fast 和 Seedance 2.0 Mini 就是为那二十版没人会看到的草稿准备的。先用 480p 花很少的积分把镜头打个样,再把跑通的那一版用旗舰模型重跑成全分辨率。
付费套餐生成的内容可根据《服务条款》用于商业用途;免费积分生成的内容仅供评估。
从你已有的一张静图,到可交付素材的最短路径。
挑你手上最清晰的那一版。如果还有第二个元素需要保持一致——一张脸、一个背景、一套配色——就把参考图一并加上。
说明主体做什么、镜头怎么走。只描述「变化」即可;已经在画面里的东西不需要再复述一遍。
选择画面比例、时长和最高 4K 的分辨率,然后开始生成。付费套餐生成内容的商业用途以《服务条款》为准。
下面每个案例形状都一样:有一个真实资产,必须精确保持它本来的样子。
一张现成的产品图就能变成旋转主视觉、细节特写或生活场景片。不用棚拍时间、不用重拍,而且包装上的品牌标志也能保持准确。
插画、主视觉、专辑封面和海报无需重画就能获得动态,用于社媒——原始构图完整保留,只是开始运动了。
一张房源照片可以变成带光影与氛围的缓慢视差推移,让房源信息拥有动态画面,而不必再约摄像师。
它根据一张静态图片加一段「该发生什么」的文字描述生成视频。图片锁定主体外观,提示词提供运动、运镜和声音。FrameAI 使用 Seedance 2.0 运行,最高支持 4K。
常规的 JPEG 和 PNG 即可。优先使用清晰、布光良好、分辨率较高的图片,避免明显的压缩噪点、水印或叠加文字——模型会把这些一并动画化。
单次请求最多 9 张参考图,同时还可附最多 3 段参考视频。Seedance 2.0 会把它们融合成一个连贯场景,而不是在它们之间切镜。
这正是图像条件化要解决的问题,在小幅度运镜下表现很稳。但当你要求镜头走到照片从未展示过的视角时,准确度会下降——所以商业项目建议把运镜控制得保守一些。
技术上可以,Seedance 2.0 对面部身份的保持也很好。但在法律上,你需要取得被拍摄者的同意——未经许可生成他人视频是你的责任,授权条款并不覆盖这一点。
会。音频与模型创造的运动同步生成,你也可以在提示词里点名想要的声音来引导它。当然也可以完全关闭。
每个工具都是同一个 Seedance 2.0 模型,只是对准了不同的活儿。你可以随意切换——积分、历史记录和导出文件是共用的。