AI 视频生成器
模型
Sora 系列

OpenAI 最新视频生成模型,增强画质

10 积分
10秒/15秒
竖屏/横屏
Veo 系列

Google 最新模型,卓越画质输出

150 积分
最长 8 秒
16:9/9:16
Seedance 系列

支持精准参考控制与原生音频的最长 30 秒多模态视频生成模型

0 积分
最长 30 秒
7 种画面比例
10s
公开可见

启用此选项后,输出的视频可能会被 AI 生成选中并发布到探索页面。

Notification
This is a notification message
示例视频

Lovart ME 上的字节跳动视频模型

Seedance 2.0 Mini AI 视频生成器

用文字、画面、视觉参考和声音提示,导演一段完整的 4-15 秒视频。

Seedance 2.0 Mini 采用统一的多模态工作流:你可以从文字场景开始,用图片固定开场与结尾,借助短视频引导动作,也能用音频规定声音方向。每份参考素材都应承担明确的制作任务,不要为了增加数量而上传无关素材。

4-15秒
灵活时长
支持范围内逐秒选择整数时长。
720p
最高输出
用 480p 试方向,用 720p 完成最终片段。
7
画面比例
覆盖横屏、竖屏、方形、超宽及自适应。
音画
原生音频
同步生成对白、环境声和音效。

01 / MODEL

Seedance 2.0 Mini 能控制什么

它的价值不只是能接收更多文件。不同输入可以分别承担视觉、动作、节奏和声音任务,让短片更容易规划与修改。

多模态场景指导

把提示词与图片、视频、音频参考组合使用。在提示词中点明每份素材,并说明它负责角色身份、构图、动作、镜头语言、节奏还是声音。

稳定的动作与交互

按顺序描述动作,交代主体、方向、速度与接触点,为肢体运动、物体交互和相机移动提供更清楚的限制。

短时多镜头叙事

在最长 15 秒内安排多个连贯镜头。标明每个镜头的景别、动作和转场,让片段有清晰的开端、发展和收束。

同步音画输出

在同一份需求中写明对白、环境底噪、音乐提示和音效。若后续有独立声音制作流程,也可以关闭音频生成。

02 / INPUTS

让每份参考素材只负责一件事

素材更多不等于结果更好。只上传能解决场景中真实不确定性的参考。

文字提示词

写清交付用途、主体、动作、场景、镜头、光线、节奏和必要声音。片段中发生场景变化时,用编号拆分镜头。

首帧与尾帧

第一张图固定开场构图,第二张图规定目标画面。重点说明两者之间如何变化,而不是只描述两张静态图。

参考图片

额外图片可用于角色、产品、环境、配色或视觉处理。保持用途互不混淆,并在提示词中使用 @Image 1、@Image 2 等标签。

参考视频与音频

短视频可引导动作、运镜或时机;音频可引导声音、节奏、环境或音效。每种媒体最多 3 个文件,各自总时长不超过 15 秒。

03 / OUTPUT

围绕发布渠道选择输出设置

先确定时长、清晰度和比例,再微调提示词。这些选择会影响构图、节奏和生成器显示的积分总额。

480p 用于方向测试

用较低积分成本比较动作、镜头顺序、节奏和参考素材。场景结构确认后再切换到 720p。

720p 用于确认成片

当构图和动作已经稳定,需要细致检查或发布时选择 720p。使用前检查面部、手部、边缘、品牌标记和小字。

从 21:9 到 9:16

16:9 或 21:9 适合宽画面,1:1 适合均衡的社交版位,9:16 适合移动端全屏。自适应会跟随最强的视觉输入。

04 / PROMPTS

面向实际制作任务的提示词模板

替换方括号内容,并删掉不影响成片的要求。每轮修改都保持参考素材标签一致。

产品动态广告

用产品图片保持外形,用短视频参考规定运镜。

提示词制作一段[时长]秒的[比例]产品广告。保持 @Image 1 中产品的外形、标签和颜色。沿用 @Video 1 的平滑环绕与加速节奏,但不要复制其场景。场景:[台面与背景]。光线:[方向与质感]。最后停在干净的产品主视觉,画面[一侧]留出文案空间。音频:[环境声与一个产品音效]。

制作提示: 确保标志和标签文字足够大,便于在结果中检查。

对白场景

用明确的说话者、景别和环境声安排一段紧凑对话。

提示词制作一段发生在[地点]的[时长]秒双人对话。镜头1:[角色A]平静地说‘[台词]’,中近景。镜头2:[角色B]先反应,再说‘[台词]’,越肩镜头。保持 @Image 1 与 @Image 2 的人物外观。停顿自然,视线一致,带轻微[环境底噪],不要字幕。

制作提示: 台词要短,发布前核对口型与具体文字。

竖屏社交短片

为 9:16 信息流设计清楚的三镜头结构,避免画面过满。

提示词制作一段关于[主题]的[时长]秒 9:16 社交视频。镜头1,0-3秒:用[动作]立即建立视觉钩子。镜头2,3-[时间]秒:用特写展示[价值点]。镜头3:明确揭示结果,上方三分之一区域保持干净。剪辑快速但可读,采用 @Video 1 的手持活力,声音明亮自然,不生成文字。

制作提示: 拼写必须准确时,把屏幕文案留给后期软件。

首尾帧转场

规定开场构图如何逐步发展为最终画面。

提示词在[时长]秒内从 @Image 1 动画过渡到 @Image 2。相机进行[运镜],同时由[主体动作]推动转场。保持主体身份、服装和配色。中间状态:[具体画面]。最后准确停在 @Image 2 的构图并保持一秒。音频:[转场声音与环境声]。

制作提示: 选择视觉上存在合理变化路径的两张画面。

05 / WORKFLOW

如何在 Lovart ME 使用 Seedance 2.0 Mini

把每次生成当作一份小型制作需求。纯文字短片和参考素材驱动的场景都可以采用这四步。

  1. 01

    选择文字或图片模式

    从需求描述创建场景时使用文生视频;需要用开场画面或视觉身份固定结果时选择图生视频。

  2. 02

    只添加有效参考

    上传首尾帧、额外图片、动作短片或声音提示。参考视频与音频各自最多 3 个文件、总计 15 秒。

  3. 03

    设置时长、格式与音频

    选择 4-15 秒、480p 或 720p,以及目标画面比例。声音属于需求的一部分时,保持同步音频开启。

  4. 04

    生成并检查完整片段

    检查镜头连续性、动作、身份、手部、口型、小字和声音时机。每次只修改一项限制,便于判断调整效果。

06 / FAQ

Seedance 2.0 Mini 常见问题

以下回答基于字节跳动公开的 Seedance 2.0 能力及 Lovart ME 当前提供的控制项。

Seedance 2.0 Mini 是什么?

Seedance 2.0 Mini 是字节跳动的视频生成模型,Lovart ME 通过 Kie.ai 提供使用入口。它支持文字及多种参考素材,可生成 4-15 秒视频并同步生成音频。

可以用图片生成视频吗?

可以。选择图生视频并至少上传一张图片。第一张图固定开场,第二张可引导结尾,其余图片可作为视觉参考。

能使用多少参考视频和音频?

最多可添加 3 个参考视频和 3 个参考音频。视频总时长不超过 15 秒,音频也需单独满足总计 15 秒的限制。

Seedance 2.0 Mini 会生成声音吗?

会。当前工作流默认开启同步音频。若对白、音乐、环境声或音效将在独立流程中制作,可以关闭此项。

支持哪些清晰度和比例?

当前接入支持 480p 与 720p;比例包括 16:9、4:3、1:1、3:4、9:16、21:9 和自适应。

上传参考视频后如何计算积分?

无参考视频时,用所选清晰度的单价乘以输出时长;有参考视频时,使用另一档单价乘以参考视频与输出视频的合计时长。生成前可在控件中看到向上取整后的总额。

生成视频可以商用吗?

使用权限取决于 Lovart ME 条款、上传参考素材的权利和适用法律。商用发布前请查看最新条款并确认所有源素材均已获得授权。