如果你想靠 AI 做 YouTube Shorts,真正需要解决的不是“怎么生成视频”,而是怎么低成本连续做出 30、50、100 条原创内容。

Flova 比较适合这个场景。

它目前可以在一个项目里完成:

脚本 → 素材分析 → Storyboard → 生图 → 生视频 → 配音 → 音乐 → Timeline → 导出。

Agent 还能分析上传的视频、图片和音频,提取关键帧、片段和音轨。

下面直接说怎么做。

01|先定一个非常窄的 Shorts 赛道

新手不要做:

科技、历史、动物、搞笑什么都发。

先选一个。

比如:

  • 30 秒历史冷知识
  • Top 5 科技产品
  • 动物微故事
  • 心理学冷知识
  • 地理奇闻

然后去 YouTube 找 10~20 条同赛道高播放 Shorts

不要下载以后直接换脸复刻。

真正要研究的是:

前 2 秒 Hook ↓ 第几秒第一次转折 ↓ 多久切一次镜头 ↓ 每句话多长 ↓ 结尾怎么留悬念

把几条参考视频交给 Flova:

分析这些 Shorts,只研究 Hook、镜头节奏、信息密度、转折方式和结尾结构。不要复制原文案、人物、场景和视觉素材。最终总结一套原创 Shorts 结构模板。

Flova Agent 支持分析视频并提取关键帧和音频,所以这个步骤可以直接在项目里完成。

学爆款结构,不要复制爆款内容。

02|第一批视频只做 20~30 秒

不要第一天就做 AI 连续剧。

先固定:

9:16 20~30 秒 5~7 个镜头 一个主题 一个 Hook 一个结尾

例如:

做一条 30 秒英文 YouTube Shorts,主题“5 个真实存在的奇怪酒店”。采用 Top 5 倒计时结构,前 2 秒给出 Hook,每个项目控制在 4~5 秒。先输出脚本和 Storyboard,不生成视频。

这一步非常重要。

Flova 本身支持:

先生成 Storyboard,再继续媒体生成。

先改文字,比生成完 7 个视频镜头再推倒重来便宜得多。

03|有人物,就先做角色设定图

AI 短片最常见的问题就是:

第一镜一个脸;

第三镜换个人;

第五镜身材也变了。

所以不要直接生成视频。

先做:

角色正面 角色侧面 半身 全身 固定发型 固定服装

然后把这些作为角色 Reference。

Prompt:
提示:

以下图片属于同一个角色。之后所有镜头固定五官、年龄、发型、身材比例和基础服装,只允许根据剧情修改表情、动作、镜头和场景。

Flova 当前接入的 Seedance 2.5 支持:

最长 30 秒单次生成 + 最多 50 个图片、视频和音频等多模态参考。

但别为了凑数量塞 50 个素材。

参考素材越精准,比参考素材越多更重要。

04|参考爆款,只复刻“运动规律和节奏”

例如看到一条视频:

人物冲进房间 →

快速推镜 →

突然停住 →

音乐 Drop →

画面反转。

可以让 Flova参考这个:

使用参考视频的镜头运动、节奏变化和动作时间点,但不要复制人物、对白、字幕、Logo、水印、场景设计和具有辨识度的原创元素。使用我的角色和原创场景重新设计。

不要做:

原视频 ↓ 换个人脸 ↓ 换几句话 ↓ 重新上传

YouTube 当前明确要求可变现内容具有原创性;大量模板化、只有表面差异的批量内容可能被归入 inauthentic content

所以:

AI 可以帮你量产,但不能把“量产”做成“换皮”。

05|Storyboard 确认后,再生成媒体

我建议固定成这个顺序:

脚本 ↓ Storyboard ↓ 角色 / 场景 ↓ 前 2~3 个镜头 ↓ 确认视觉风格 ↓ 剩余镜头 ↓ Voiceover ↓ BGM ↓ Timeline

不要一上来就让 AI:

全部生成完。

更好的 Prompt:

Storyboard 已确认。先生成 Shot 1~3。保持角色 Reference 一致,9:16,节奏偏快。旁白暂时不要生成。等我确认视觉方向以后,再继续 Shot 4~7。

这样如果风格错了,

只浪费 3 个镜头。

而不是整条视频。

06|某个镜头崩了,只改那个镜头

例如:

Shot 4 手指异常;

角色突然换脸;

动作太慢;

构图不对。

不要重新生成整条视频。

直接:

只重新生成 Shot 4。保留角色、服装、场景、构图和时长,只修改手部动作,让人物自然拿起手机。其他 Shot 不要修改。

Flova 的 Storyboard、媒体版本和 Timeline 都可以继续编辑、重新生成和重新绑定。

AI 视频真正省成本的关键,不是一次生成完美,而是局部返工。

07|配音和音乐最后再做

画面确定以后再生成 Voiceover。

例如英语 Shorts:

使用自然美式英语旁白,语速偏快但清晰,不要播音腔。每句话尽量短,旁白必须在对应镜头结束前完成。

然后再做 BGM:

BGM 负责增强节奏,不要盖住 Voiceover。前 2 秒增强 Hook,中段保持推进感,结尾制造一次明显停顿。

Flova Agent 本身可以协调视频、音乐和 Voiceover,并将媒体组装到 Timeline。

但最终仍建议自己完整看一遍:

旁白有没有压字 音乐有没有盖人声 镜头有没有空拍 转场有没有拖节奏

08|别一开始追求 4K

这里特别纠正一个网上常见说法。

Flova 里的 Seedance 2.5 确实支持:

最长 30 秒生成。

但不要理解成:

原生生成 30 秒 4K。

目前 Flova 的 4K 是单独通过:

AI Upscale

完成。

视频可以 Upscale 到:

1080p 2K 4K

并可选择:

24fps 30fps 60fps

这个功能目前属于付费能力。

做 Shorts 前期完全没必要死磕 4K。

720p/1080p 内容没人看,升到 4K 也救不了播放量。

09|跑通以后,把流程封成 Skill

假设你已经连续跑了 10 条,发现最稳定的结构是:

Top 5 + 30 秒 + 前 2 秒 Hook + 7 个 Shot + 固定字幕 + 固定英语 Voice + 固定视觉风格

这时候不要每次重新写一大段 Prompt。

直接做成 Flova Skill。

Skill 可以定义:

  • 素材怎么分析
  • Storyboard 怎么写
  • 用什么模型
  • Reference 怎么使用
  • Prompt 怎么组织
  • Timeline 怎么剪
  • 音频怎么处理

以后只改主题即可,剩下的继续按同一套生产规则执行。

10|成片不满意,可以继续进 PR

如果 Flova 生成的结果已经有 80 分:

直接 Export Video。

如果还需要精修:

Export ↓ PR File

Flova 官方目前支持把项目导出为包含媒体资源和编辑工程的 Package,可以继续在 Premiere Pro 中处理;官方同时提到 Jianying、CapCut、Final Cut Pro 等后续编辑场景。

所以我的建议不是:

以后完全不用剪辑软件。

而是:

让 AI 做掉前面最重复的 80%,人工只做最后决定质量的 20%。

11|发布以后,只看这几个数据

第一批不要想着赚钱。

先发 30 条

每条重点看:

Viewed vs Swiped Away

判断 Hook。

如果开头大量划走:

重写前 2 秒。

Audience Retention

判断哪个时间点掉人。

如果:

0~2 秒正常 7 秒突然掉一半

就回去看第 7 秒发生了什么。

Average Percentage Viewed

判断整条内容有没有看完。

Subscribers

播放很多但没人关注:

说明视频可能能获取流量,

但没有形成账号价值。

你的循环应该是:

发布 → 看数据 → 修改模板 → 更新 Skill → 再生成。

12|做到什么程度才能拿 Shorts 广告收入?

截至 2026 年 8 月,完整 YouTube Partner Program 的 Shorts 路线仍是:

1000 Subscribers + 最近 90 天 1000 万有效公开 Shorts Views

满足以后还要经过频道审核,并不是达到门槛后自动审核通过。

还有较低的一档:

500 Subscribers + 90 天至少 3 条公开内容 + 300 万 Shorts Views / 90 天

可以解锁部分:

会员、Super Thanks、Shopping 等功能,

但不是完整 Shorts Feed 广告分成。

另外需要提前知道:

从 2027 年 2 月 1 日开始,新申请完整 YPP 的 Shorts 门槛将变成 2000 万 Qualified Shorts Views / 90 天,同时仍需 1000 Subscribers。

13|Shorts 到底怎么分钱?

不是:

100 万播放 × 固定单价。

Shorts Feed 广告收入会先进入 Creator Pool,

再根据符合条件的观看份额进行分配。

创作者最终保留自己分配金额的:

45%。

所以不要在做号之前幻想:

“100 万英语播放一定赚多少钱。”

地区、广告需求、有效观看、月份等都会影响结果。

14|最后一个最重要的避坑:AI 视频可以赚钱,但不能批量灌水

YouTube 官方并没有禁止 AI 视频变现。

官方甚至明确表示:

使用 AI 本身不会让频道失去变现资格。

但如果一个频道全是:

相同模板 相同故事 相同旁白 相同镜头 只换关键词

就可能碰到 inauthentic content。

另外,如果 AI 生成了看起来非常真实的:

真实人物行为;

现实事件;

真实地点发生的虚构事件;

上传时需要在 YouTube Studio 的 AI use 中进行披露。

正常披露本身不会影响推荐或变现资格

最后

如果让我从零开始,我不会同时做 5 个赛道。

我会:

选 1 个赛道 ↓ 拆 20 条爆款 ↓ 做 1 套 Shorts 模板 ↓ Flova 跑 10 条 ↓ 根据数据修改 ↓ 再跑 20 条 ↓ 找到有效模板 ↓ 封装成 Skill ↓ 扩大产量

AI Shorts 真正值得利用的,不是“一键躺赚”,而是把每次内容实验的成本压到足够低。

当别人测试一个选题需要半天,

你能在同样时间测试 5 个。

这才是 AI 视频工具真正的优势。

总结起来就是先验证内容,再放大产量;先跑通流量,再谈收入。