精通 Seedance 2.5:AI 生成短剧终极指南

@fuji_ai_
日语2026年8月10日
142K
149
13
3
326

TL;DR

这是一份关于使用 ByteDance 旗下 Seedance 2.5 进行 AI 视频创作的综合指南,重点介绍了如何通过结构化提示词,制作出角色一致且音频同步的 30 秒竖屏短剧。

说实话,我盯着屏幕看了又看,愣住了。

如今,打开 TikTok 或 YouTube,竖屏短剧层出不穷。

而现在,这些只需一句提示词就能生成。

对白、音效、BGM——全都包含在内。

不用拍摄。不用演员。不用剪辑。

成本大约是每支视频 1,400 日元。

很多人大概会想着「听说很厉害」,就这么划过去了。这种心情我非常理解。

一开始我也以为,「大概就是几秒钟的 CG 视频吧。」

但实际生成出来的,是一段 30 秒、演员口型完全对得上的视频,甚至还有我根本没有指定的镜头切换。

这不仅仅是「生成了视频」,而是「诞生了一件作品」。

所以我写下了这篇文章。

文中附带了完整提示词,你可以直接复制粘贴立即使用。

另外,我运营着一个 LINE Open Chat,分享文章里写不下的 AI 活用故事。不论你是在读这篇文章之前还是之后看到这段介绍,都可以在那里免费领取「32 项 AI 豪华战略特典」。参加完全免费,欢迎随时来看看。

▼ Open Chat「Fuji AI【最新情报】」

可以从我的个人资料中的链接加入。

那么,我们开始吧。

◾️ Seedance 2.5 是什么?

Seedance 2.5 是由 ByteDance 开发的新一代 AI 视频生成模型。它可以根据文本、图像、音频、视频等输入,一次性生成最长 30 秒、带声音的叙事视频。

它由 TikTok 的母公司 ByteDance 打造,于 2026 年 7 月 31 日发布。

你只需要记住三个主要特点:

① 一次生成 30 秒,并且带声音

上一代 2.0 只有 15 秒,这一代正好翻了一倍。而且,镜头切换也由模型自行完成。即使你不指定,它也会自动从全景切到特写。

② 最多可提供 50 份参考素材

具体分配是 30 张图像、10 段视频和 10 份音频。你可以固定角色的长相、服装、场景,甚至连声音都能固定。这个「声音固定」在之后会发挥非常大的作用。

③ 视频与声音同步生成

它不是先做视频再加声音,而是从一开始就同步生成。因此,口型和声音不会错位。

以上就是 Seedance 2.5 的基本情况。不过,先提醒你一句。

这不是一个单纯「画质提升」的模型。

官方博客对分辨率只字未提。实际服务中,你只能在 480P 和 720P 之间选择,连 1080P 的选项都没有。网上有些文章声称「4K 版重磅发布」,这与官方价格表互相矛盾。

它是一个为「时长」和「一致性」而设计的模型。这样理解才是正确的。

◾️ 竖屏短剧选择它的唯一理由

我选择它的理由很简单:时长。

无论 Google 的视频 AI 性能有多强,它一次也只能生成 10 秒。这与竖屏短剧从根本上就不兼容。竖屏短剧的结构是「钩子 → 铺垫 → 反转 → 爽点」,正好需要 30 秒。如果分成三段 10 秒再拼接,镜头切换处脸会变,氛围也会变。到第三个镜头时,主角已经和第一个镜头不是同一个人了。目前能一口气生成 30 秒的,只有 Seedance。所以做竖屏短剧,选它而不选 Google。

◾️ 来试试吧(只需复制粘贴)

这并不难。按照步骤来,你一定能做到。

[第 1 步:打开 Dreamina]

藤原弘人@AI起業家 - inline image

在日本使用 Seedance 2.5 的入口,是一个名为 Dreamina 的服务。它与 CapCut 同属 ByteDance 旗下,界面已完全本地化。

[第 2 步:登录]

藤原弘人@AI起業家 - inline image

登录方式有五种:Google、TikTok、Facebook、Email 或 CapCut Mobile。用 Google 最快。

[第 3 步:将模型切换为 Seedance 2.5]

藤原弘人@AI起業家 - inline image

点击左下角的「AI 视频」,就会显示模型列表。选择「Dreamina Seedance 2.5」。只有 2.5 能连续输出 30 秒。

[第 4 步:调整三项设置]

将模型右侧的选项设置如下:

  • 生成模式:Omni-reference(默认即可)
  • 画面比例与分辨率:9:16 / 720P
  • 时长:30 秒

关键在于,生成按钮左侧会显示积分消耗量。每次生成都要花钱,所以请养成先确认这个数字的习惯。

[第 5 步:复制、粘贴并发送以下内容]

什么都不用改。

▼ 请把下面全部复制粘贴 ▼

text
1请制作一部 30 秒的竖屏短剧(9:16)。节奏参考中国竖屏短剧,情绪强烈,结构上要在结尾实现地位关系的完全反转。
2[角色定义]
3主体 1 = 40 多岁的日本男性。短发,穿黑色围裙,店长。
4主体 2 = 快 30 岁的日本男性。黑发,灰色连帽衫,背着双肩包。
5主体 3 = 30 多岁的日本女性。深蓝色西装,拿着一个信封。
6此后请始终使用这些名称。
7[镜头构成]
8镜头 1(0-3 秒)
9- 镜头:主体 1 的固定半身镜头
10- 动作:主体 1 双臂交叉,轻蔑地笑着,俯视对方
11- 声音:(无音乐,只有店内嘈杂声)/ 用日语说{连排队都不懂的客人,我们不需要。}
12镜头 2(3-9 秒)
13- 镜头:缓慢推近主体 2 的脸部
14- 动作:主体 2 低下头,慢慢调整双肩包背带
15- 声音:用日语说{……对不起} / <餐具轻轻碰撞的声音>
16镜头 3(9-16 秒)
17- 镜头:店内固定中景
18- 动作:周围几位顾客尴尬地移开视线
19- 声音:(一声低沉的长音)/ <拉门轻轻打开的声音>
20镜头 4(16-22 秒)
21- 镜头:从入口缓慢向店内推进
22- 动作:主体 3 走进店内,双手将一个信封和一把钥匙递给主体 2
23- 声音:(弦乐气势渐强)/ 主体 3 用日语说{我是从总部来的。这是明天起店长交接的文件。}
24镜头 5(22-27 秒)
25- 镜头:主体 2 双手的固定特写
26- 动作:主体 2 默默接过钥匙。主体 1 半张着嘴僵住
27- 声音:主体 2 用日语说{我想亲自到现场看过之后再决定} / 主体 1 用日语说{诶?}
28镜头 6(27-30 秒)
29- 镜头:三人同框的固定中景
30- 动作:主体 1 后退半步。主体 2 停顿一拍后回击。主体 3 微微别过脸
31- 声音:(音乐突然变得轻快)/ 主体 2 用日语说{从明天开始,能教教我怎么排队吗?} / 主体 3 轻声用日语说{店长,那位是新的店长。}
32[导演指示]
33- 真人实拍 / 超写实 / 自然的日本演员
34- 深夜的小型拉面店。暖色灯光,低饱和度
35- 情绪饱满的表演。只有主体 1 提高音量
36- 9:16,高质量,画面稳定,无模糊,无抖动
37[一致性规格]
38同一个人,服装一致,发型不变。所有镜头中保持外貌和服装统一。不要出现两个或以上外貌/服装完全相同的人(禁止双胞胎效果)。
39[禁止事项]
40- 画面上不得出现字幕、说明文字、LOGO、水印或任何文字
41- 不得出现真实人物或真实品牌 LOGO
42- 招牌、菜单或文件上不得出现可读的文字
43- 不得出现奔跑、大幅跳跃或剧烈旋转
44[结尾收束]
45传达出居高临下的那个人因一份文件而失去地位的瞬间快感。只有主体 1 可以大声;主角直到最后都保持安静。请通过表情、表演和运镜来呈现,即使没有字幕也能看懂剧情。

◾️ 官方文档中「不要做」的 6 件事

藤原弘人@AI起業家 - inline image

1. 不要提供角色三视图

与动漫不同,提供正面/侧面/背面视图会让模型以为有三个人,导致面部崩坏。请使用一张表情自然的正面大头照。

2. 不要把参考素材用满

最多可以加 50 份,但推荐 4-5 份。太多了模型会搞不清优先级。

3. 不要在同一个镜头里指定多种运镜

「一边平移环绕一边缓慢推进」会导致画面崩坏。一个镜头 = 一种运镜。

4. 不要把剧本直接粘贴进提示词

冗余的文字会扰乱模型。请像上面的提示词一样,使用结构化格式。

5. 不要试图固定 seed

固定 seed 对 Seedance 2.0 系列不起作用。一致性是靠参考图和角色定义来实现的。

6. 不要写剧烈动作

避免奔跑或跳跃。优先写缓慢、连续的微小动作。

◾️ 日语对白不这样写,就会出现口音

藤原弘人@AI起業家 - inline image

日语对白,一定要写明语言名称。

×「对不起,果然还是不行」

○ 用日语说{对不起,果然还是不行}

如果不这样做,对白可能会带中文口音,甚至突然说起英语。另外,括号要正确区分:() 是音乐,<> 是音效,{} 是对白,【】 是字幕。

◾️ 要改写成自己的故事时,按这个顺序写

藤原弘人@AI起業家 - inline image

明确的主体 + 动作细节 + 场所/环境 + 光线/色调 + 运镜 + 视频风格 + 画质 + 约束条件

请把它当作工程规格书,而不是诗。

连声音都可以指定

你可以用文字指定情绪、语气和语速:

用日语说{台词},情绪为[情绪],语气为[语气],语速为[语速]。

◾️ 第一次失败了怎么办

藤原弘人@AI起業家 - inline image

修复的方法不是「加字」,而是「堵死退路」。

  1. 删掉所有模棱两可的词,比如「如果可以的话」「尽可能」。
  2. 不要在一行里写两个指令。
  3. 在结尾写明「你希望看到的效果」。

◾️ 30 秒视频有现成的成功模板

藤原弘人@AI起業家 - inline image
  • 0-2 秒:钩子(不适感或意外)
  • 2-18 秒:冲突(被轻视)
  • 18-26 秒:反转(用钥匙、文件之类的道具来呈现)
  • 26-30 秒:结局/收尾

◾️ 做续集,只需提供第一集视频

想做系列的话,把第一集视频放进参考素材,并在提示词中指定为 @Video1。这样就能保持角色长相、服装和店铺不变。

◾️ 有两件事我不会交给 AI

  1. 音频: 我不会完全依赖它。想要高质量,就生成无声视频,之后再配音。
  2. 竖屏生成: 官方 FAQ 提到,按 9:16 生成时,更大概率会出现多余的字幕。先按 16:9 生成再裁成竖屏,更适合量产。

◾️ 「一支视频 1,400 日元」的真相

这是一次成功时的价格。实际上,算上重试,每集大概要 8,000 到 10,000 日元。不过,和真人拍摄短片约 160,000 日元的市场价相比,完全是另一个量级。

◾️ 靠这个能赚钱吗?

在中国,95% 的竖屏短剧已经由 AI 制作。每万次播放的收益下降了 90%。门槛降低了,意味着竞争爆发了。AI 无法保证盈利;它能保证的是,让你用很低的成本去测试大量创意。日本目前才刚走到这个阶段的入口。

◾️ 总结

  • Seedance 2.5 主打时长(30 秒)和一致性,而不是 4K 分辨率。
  • 对白要使用明确的括号,并写明「用日语说」。
  • 修复问题不是靠加字,而是在禁止事项上做到绝对。
  • AI 不会让「成功率」变得更高,但会让「试错成本」大幅降低。

◾️ 如果今天只做一件事

打开 Dreamina,把本文的提示词粘贴进去试一次。不要只是读完就信了,动起手来,亲自体验那个惊喜的瞬间。

最后

为了不让你「读完就结束」,我准备了 32 项豪华特典免费赠送,其中包括 ChatGPT、Claude 的活用指南和 AI 副业指南。

藤原弘人@AI起業家 - inline image

点击这里加入。

二次创作

使用 YouMind 创作爆款文章

收集素材、拆解爆点、生成视觉资产、撰写内容,并在一个 AI 工作空间里完成分发。

了解 YouMind
写给创作者

把你的 Markdown 变成干净的 𝕏 文章

图片上传、表格、代码块,往 𝕏 上手动重排太痛苦。YouMind 把整篇 Markdown 一键转成干净、可直接发布的 𝕏 文章草稿。

试试 Markdown 转 𝕏

更多可拆解样本

近期爆款文章

探索更多爆款文章