7.4 视频:从素材到成片
一句话:AI 视频目前的正确打开方式是分镜拼接——每个镜头几秒,AI 生成片段,剪映组装成片。别指望一句话出电影,但社团宣传片和课程作业短片已经够用。
本讲你将学到
- 三种 AI 视频玩法:文生视频、图生视频、自动字幕
- 一条完整的学生级工作流
- 时长限制与应对
- 视频专属的红线
三种玩法
| 玩法 | 输入 → 输出 | 适合 |
|---|---|---|
| 文生视频 | 提示词 → 几秒动态画面 | 空镜、氛围镜头 |
| 图生视频 | 一张图 → 让它动起来 | 主力:先把图画满意(7.1),再动起来 |
| 自动字幕 | 视频 → 逐句字幕 | 口播、采访、vlog 必备 |
工具:即梦、可灵(图生视频质量好)、海螺 AI(MiniMax H3,文生 / 图生视频第一梯队,自带音画同步,基础免费)、剪映(字幕 + 剪辑)。
学生级完整工作流
以「社团招新宣传片,60 秒」为例:
- 脚本:文本 AI 写 60 秒分镜脚本(镜号 / 画面 / 文案),用 2.2 ICIO 的姿势提需求;
- 分镜图:每个镜头先生成静态图(7.1 生图),满意了再进入下一步——图不满意就动起来,废片率极高;
- 图生视频:每张图生成 3~10 秒动态片段;
- 配音:文案用 AI 配音(7.3);
- 组装:剪映里拼片段 + 对字幕 + 卡音乐点。
核心心法:静态图是视频的地基。 在图片阶段反复打磨,比在视频阶段返工便宜十倍。
时长限制
单次生成普遍只有几秒到十几秒。这不是缺陷,是设计约束:像拍镜头一样思考——60 秒宣传片 = 10 个 6 秒镜头,本来就该这么拆。
视频红线
三条高压线
- 换脸 / deepfake:把任何人的脸合成到视频里,未经同意即侵权,用于欺骗就是违法(6.3 有完整案例);
- 别造「新闻画面」:AI 生成的灾害、事件画面冒充真实新闻传播 = 造谣;
- 素材与音乐版权:BGM 用剪映曲库或明确可商用的,别随手扒热门歌曲。
跟做练习(约 30 分钟)
用 7.1 生成的那张海报图 → 图生视频出 3 秒动态 → 加一句 AI 配音字幕 → 导出一个 5 秒小成片。跑通全链路,你就拥有了一条能无限复用的生产线。
下一步
视听篇毕业。回到文本世界,下一站是全站「灵魂篇」——用 AI 学习,而不是用 AI 代劳。→ 8.1 先想清楚:替你学还是帮你学