Lovart ME 上的字节跳动视频模型
Seedance 2.0 Mini AI 视频生成器
用文字、画面、视觉参考和声音提示,导演一段完整的 4-15 秒视频。
Seedance 2.0 Mini 采用统一的多模态工作流:你可以从文字场景开始,用图片固定开场与结尾,借助短视频引导动作,也能用音频规定声音方向。每份参考素材都应承担明确的制作任务,不要为了增加数量而上传无关素材。
- 4-15秒
- 灵活时长
- 支持范围内逐秒选择整数时长。
- 720p
- 最高输出
- 用 480p 试方向,用 720p 完成最终片段。
- 7
- 画面比例
- 覆盖横屏、竖屏、方形、超宽及自适应。
- 音画
- 原生音频
- 同步生成对白、环境声和音效。
01 / MODEL
Seedance 2.0 Mini 能控制什么
它的价值不只是能接收更多文件。不同输入可以分别承担视觉、动作、节奏和声音任务,让短片更容易规划与修改。
多模态场景指导
把提示词与图片、视频、音频参考组合使用。在提示词中点明每份素材,并说明它负责角色身份、构图、动作、镜头语言、节奏还是声音。
稳定的动作与交互
按顺序描述动作,交代主体、方向、速度与接触点,为肢体运动、物体交互和相机移动提供更清楚的限制。
短时多镜头叙事
在最长 15 秒内安排多个连贯镜头。标明每个镜头的景别、动作和转场,让片段有清晰的开端、发展和收束。
同步音画输出
在同一份需求中写明对白、环境底噪、音乐提示和音效。若后续有独立声音制作流程,也可以关闭音频生成。
02 / INPUTS
让每份参考素材只负责一件事
素材更多不等于结果更好。只上传能解决场景中真实不确定性的参考。
文字提示词
写清交付用途、主体、动作、场景、镜头、光线、节奏和必要声音。片段中发生场景变化时,用编号拆分镜头。
首帧与尾帧
第一张图固定开场构图,第二张图规定目标画面。重点说明两者之间如何变化,而不是只描述两张静态图。
参考图片
额外图片可用于角色、产品、环境、配色或视觉处理。保持用途互不混淆,并在提示词中使用 @Image 1、@Image 2 等标签。
参考视频与音频
短视频可引导动作、运镜或时机;音频可引导声音、节奏、环境或音效。每种媒体最多 3 个文件,各自总时长不超过 15 秒。
03 / OUTPUT
围绕发布渠道选择输出设置
先确定时长、清晰度和比例,再微调提示词。这些选择会影响构图、节奏和生成器显示的积分总额。
480p 用于方向测试
用较低积分成本比较动作、镜头顺序、节奏和参考素材。场景结构确认后再切换到 720p。
720p 用于确认成片
当构图和动作已经稳定,需要细致检查或发布时选择 720p。使用前检查面部、手部、边缘、品牌标记和小字。
从 21:9 到 9:16
16:9 或 21:9 适合宽画面,1:1 适合均衡的社交版位,9:16 适合移动端全屏。自适应会跟随最强的视觉输入。
04 / PROMPTS
面向实际制作任务的提示词模板
替换方括号内容,并删掉不影响成片的要求。每轮修改都保持参考素材标签一致。
产品动态广告
用产品图片保持外形,用短视频参考规定运镜。
制作一段[时长]秒的[比例]产品广告。保持 @Image 1 中产品的外形、标签和颜色。沿用 @Video 1 的平滑环绕与加速节奏,但不要复制其场景。场景:[台面与背景]。光线:[方向与质感]。最后停在干净的产品主视觉,画面[一侧]留出文案空间。音频:[环境声与一个产品音效]。制作提示: 确保标志和标签文字足够大,便于在结果中检查。
对白场景
用明确的说话者、景别和环境声安排一段紧凑对话。
制作一段发生在[地点]的[时长]秒双人对话。镜头1:[角色A]平静地说‘[台词]’,中近景。镜头2:[角色B]先反应,再说‘[台词]’,越肩镜头。保持 @Image 1 与 @Image 2 的人物外观。停顿自然,视线一致,带轻微[环境底噪],不要字幕。制作提示: 台词要短,发布前核对口型与具体文字。
竖屏社交短片
为 9:16 信息流设计清楚的三镜头结构,避免画面过满。
制作一段关于[主题]的[时长]秒 9:16 社交视频。镜头1,0-3秒:用[动作]立即建立视觉钩子。镜头2,3-[时间]秒:用特写展示[价值点]。镜头3:明确揭示结果,上方三分之一区域保持干净。剪辑快速但可读,采用 @Video 1 的手持活力,声音明亮自然,不生成文字。制作提示: 拼写必须准确时,把屏幕文案留给后期软件。
首尾帧转场
规定开场构图如何逐步发展为最终画面。
在[时长]秒内从 @Image 1 动画过渡到 @Image 2。相机进行[运镜],同时由[主体动作]推动转场。保持主体身份、服装和配色。中间状态:[具体画面]。最后准确停在 @Image 2 的构图并保持一秒。音频:[转场声音与环境声]。制作提示: 选择视觉上存在合理变化路径的两张画面。
05 / WORKFLOW
如何在 Lovart ME 使用 Seedance 2.0 Mini
把每次生成当作一份小型制作需求。纯文字短片和参考素材驱动的场景都可以采用这四步。
- 01
选择文字或图片模式
从需求描述创建场景时使用文生视频;需要用开场画面或视觉身份固定结果时选择图生视频。
- 02
只添加有效参考
上传首尾帧、额外图片、动作短片或声音提示。参考视频与音频各自最多 3 个文件、总计 15 秒。
- 03
设置时长、格式与音频
选择 4-15 秒、480p 或 720p,以及目标画面比例。声音属于需求的一部分时,保持同步音频开启。
- 04
生成并检查完整片段
检查镜头连续性、动作、身份、手部、口型、小字和声音时机。每次只修改一项限制,便于判断调整效果。
06 / FAQ
Seedance 2.0 Mini 常见问题
以下回答基于字节跳动公开的 Seedance 2.0 能力及 Lovart ME 当前提供的控制项。
Seedance 2.0 Mini 是什么?
Seedance 2.0 Mini 是字节跳动的视频生成模型,Lovart ME 通过 Kie.ai 提供使用入口。它支持文字及多种参考素材,可生成 4-15 秒视频并同步生成音频。
可以用图片生成视频吗?
可以。选择图生视频并至少上传一张图片。第一张图固定开场,第二张可引导结尾,其余图片可作为视觉参考。
能使用多少参考视频和音频?
最多可添加 3 个参考视频和 3 个参考音频。视频总时长不超过 15 秒,音频也需单独满足总计 15 秒的限制。
Seedance 2.0 Mini 会生成声音吗?
会。当前工作流默认开启同步音频。若对白、音乐、环境声或音效将在独立流程中制作,可以关闭此项。
支持哪些清晰度和比例?
当前接入支持 480p 与 720p;比例包括 16:9、4:3、1:1、3:4、9:16、21:9 和自适应。
上传参考视频后如何计算积分?
无参考视频时,用所选清晰度的单价乘以输出时长;有参考视频时,使用另一档单价乘以参考视频与输出视频的合计时长。生成前可在控件中看到向上取整后的总额。
生成视频可以商用吗?
使用权限取决于 Lovart ME 条款、上传参考素材的权利和适用法律。商用发布前请查看最新条款并确认所有源素材均已获得授权。
07 / NEXT
继续选择合适的视频工作流
可以比较更轻量的 Seedance 版本,返回完整模型选择器,或先查看公开案例。