如何在 20 分钟内掌握 80% 的 AI UGC 创作技巧

@beechinour
英语2026年8月10日
186K
219
15
8
639

TL;DR

本指南概述了创作写实 AI UGC 视频的 20 分钟工作流,重点介绍了多 Agent 脚本验证、Seedance 2.5 生成以及专业剪辑技巧,助你避开 AI 生成内容的廉价感。

这是一个实战指南:看完后你会知道怎么写一条不像垃圾的 UGC 脚本、生成视频、剪辑、然后拿去让真人测试。还会告诉你全部成本。准备好之后大概 20 分钟,几美元。

先把话说清楚:这篇不是 higgsfield 或任何人的赞助。我也不是做 UGC 运营的,我做 AI 广告。从 12 月开始,我一直在密切关注那些真正靠这个赚钱的人,主要是我朋友 @maxxmalist@Mho_23,还有其他一些人,同时我也在跑自己的测试。每一个数字都有来源或截图,截图就是我自己第一次跑这套流程的真实记录。

为什么是现在

我一直拿 AI 视频去测身边的人,看他们会不会信以为真。

好多年里我们基本一眼就能看出来。皮肤会露馅——那种塑料感加上死气沉沉的样子,让任何酷的东西都变成 AI 垃圾。

然后 seedance 2.5 发布了,皮肤终于像真人了。@maxxmalist 这条帖子只是众多例子之一,足以说明这个模型有多离谱:

https://x.com/maxxmalist/status/2085330197524390113

https://x.com/eptwts/status/2085141769755242580

先写脚本,别先挑模型

脚本才是留住或劝退观众的关键,永远都是。

每篇 AI UGC 教程都把篇幅花在生成环节,部分原因是生成工具就是赞助商卖的东西。ep(@eptwts)写的 seedance 工作流拆解确实很棒。

但你滑一下自己的信息流:能留住你的视频,都是第一句话就击中你,下一句话勾着你往下看。这是写作的功夫,模型代替不了。

第一步:搭一个评审团(一次性,约 10 分钟)

提升脚本能力,不是靠一个人闷头多写就能练出来的。而是靠快速被撕碎——被比你观众更挑剔的读者撕个几百次练出来的。

系统是这样的:

  1. 创建一个独立的 Claude Agent,只负责写脚本
  2. 给它一组评审技能,每个技能只管一件事:一个管节奏,一个管用词,一个管创意,一个管结构
  3. 给每个评审喂一份大型 swipe file(素材库),内容来自符合你风格和品味的人:你欣赏的作家和创作者的逐字稿、脚本、开头钩子、创意。练节奏的话,gary provost 是经典选择,但任何能让你刷屏停下来的写作者都行。我实际的建议是:找一个不完美的来源,比如一个真实的 TikTok 博主,把他们的整个主页上传给脚本 Agent。UGC 脚本听起来本来就不该是精雕细刻的文案
  4. 给 Agent 喂一批已经跑出过成绩的脚本,你自己的或你研究过的都行
  5. 你写的每一条脚本,在生成任何一帧画面之前,都要先过一遍完整的评审团

技能就是一份 Agent 会加载的指令文件:这个评审是谁、它在乎什么、什么情况下会毙掉一条脚本。写的时候,把它当成写给一个只负责一件事的狠人组员的任务简报。

我个人觉得这里最值得做的事是:让至少一个评审 100% 基于一个真实的 UGC 创作者训练,你可以把他们所有的视频和脚本全部抓下来。

(如果你看得一头雾水,直接把这篇文章粘贴给 Claude 就行)

我发的所有东西都会过七个评审,包括这篇文章(你自己想设几个都行)。这就是我的内容读起来不像垃圾的唯一原因。

beech - inline image

写好脚本,让评审团打分,重写,再跑一遍。等它能活下来,你就有了值得花钱的东西(做 AI UGC 的话,一次最好写 10 条以上)。

第二步:生成视频

seedance 2.5 就是那个改变我想法的模型。higgsfield 可能是跑它最方便的地方,dreamina 和 freepik 也都能用。

如果已经有一条为类似产品跑出过转化的 UGC 视频,直接拿来用:喂给 gemini,让它输出一份 1:1 带时间戳的逐帧拆解。这份拆解就是你的提示词,你那条通过评审的脚本作为对话内容放进去(ep 写过这套工作流的深度版本)。

想从零开始?两个提示词就够了:先出首帧,再出视频。

用 gpt-images-2 生成首帧(nano banana 也行)。诀窍是堆叠真实感关键词,这样就不会得到那种精致的 AI 感:

超真实 iPhone 前置摄像头自拍,25 岁左右的女性坐在停好的车的驾驶座上,午后自然光透过挡风玻璃,凌乱的丸子头,宽松连帽衫,真实的皮肤质感,毛孔可见,淡淡的眼下阴影,讲话讲到一半的随意神态,一只手举着对镜头说话,浅景深,柔和暖色调,真实的 TikTok vlog 质感,无文字,无字幕,9:16

然后把这张图作为参考帧喂给 seedance 2.5,围绕你的脚本生成视频。按分镜拆解的结构来写,一秒一秒拆:

主体:参考帧里的那位女性,同样的头发,同样的连帽衫,同样的车

镜头:手持前置摄像头自拍视角,胸部以上取景,自然的轻微晃动,9:16

音频:清晰的手机麦克风人声,带一点房间环境底噪,无背景音乐

00:00-00:03 她微微向镜头前倾,带着说到一半的劲头:[你的钩子台词]

00:03-00:12 自然眨眼,小幅头部动作,思考中停顿一下:[你的脚本正文]

00:12-00:15 微微一笑,直视镜头说出收尾台词:[你的行动号召]

保持皮肤质感,不要美颜滤镜感,口型同步,15 秒

设置 9:16,从 720p 起跑,满意这版再升级分辨率。视频长度要跟你写的时间戳对齐,不然声音会和画面脱节。

beech - inline image

seedance 会把烂脚本和好脚本渲染得一样漂亮。这就是整个行业马上要踩进去的陷阱。

第三步:当成真实素材来剪辑

生成出来的只是原始素材,所以得像对待素材一样去剪:剪掉开头多余的空白,收紧每一处停顿,加字幕,垫一段背景音——就像你剪一个真实博主的自拍视频那样。

beech - inline image

流程跑通了,就把它变成机器

持续跑你自己的测试,直到视频能稳定地以假乱真。调整评审、提示词、剪辑。这套流程才是你真正的资产。

然后用 wispr flow 把整套流程灌进 fable 5,打造你自己的机器:一个能规模化跑你这套流程的 Agent。在手工把流程打磨好之前别做这一步——自动化一套有问题的流程,只会更快地产出垃圾。

要花多少钱

在 dreamina 上,一条 720p 8 秒的视频大约消耗 296 积分,在 $19 的入门套餐下折合约 $3.50。综合各平台来看,720p 下每条大约 $2.50 到 $6(来源)。

(价格和模型开放情况变得很快,别急着信我,先自己查。我这次实际的花费在上面的截图里。)

所以你第一条能以假乱真的视频:大约 20 分钟时间,成本不到一顿午饭。现在你明白为什么那些规模化跑这个的人都在印钞了。

你的第一个 20 分钟

计时开始前,先做一次性准备:搭好评审 Agent(约 10 分钟)

  • 0-8 分钟:写你的第一条脚本,让评审团撕碎它,重写到听起来自然为止
  • 8-14 分钟:用 gpt-images-2 生成首帧,把脚本粘贴进视频提示词,在 seedance 2.5 上生成
  • 14-18 分钟:capcut 过一遍。删空白、加字幕、配乐
  • 18-20 分钟:像普通观众一样看一遍。如果连你自己都不会停下刷屏,那问题就在脚本,回去找评审团

收藏这篇文章,今晚就跑一遍。

想要更多 AI 视频干货,来我免费的 tg:t.me/beechhq

二次创作

使用 YouMind 创作爆款文章

收集素材、拆解爆点、生成视觉资产、撰写内容,并在一个 AI 工作空间里完成分发。

了解 YouMind
写给创作者

把你的 Markdown 变成干净的 𝕏 文章

图片上传、表格、代码块,往 𝕏 上手动重排太痛苦。YouMind 把整篇 Markdown 一键转成干净、可直接发布的 𝕏 文章草稿。

试试 Markdown 转 𝕏

更多可拆解样本

近期爆款文章

探索更多爆款文章