没素材可拍:用 AI 生成视频填补画面
AI 生成视频不是用来替代实拍的,是用来「填空」的——只要观众不觉得画面停滞就够了。
适用:口播讲到抽象概念时没有画面可配的创作者。有个重要原则:AI 生成画面只做「辅助说明」,绝不做「证据」。涉及真实产品、真实效果、真实场景的地方,必须用实拍,否则容易变成虚假宣传。
操作流程
1
先列「画面清单」,标出哪些必须实拍
约 10 分钟想到哪配到哪,一定乱。先把脚本逐句过一遍,标出「这里观众应该看到什么」,再去生成。
- 把口播稿按句拆开,每句标一个画面需求。
- 分成三类:实拍可得 / AI 可生成 / 用大字卡代替。
- 凡是涉及产品效果、真实数据的画面,一律归到实拍类。
可直接套用的提示词
我有一条口播视频,需要配画面,但很多内容没有实拍素材。请帮我做画面规划。 口播稿:______ 我手上有的实拍素材:______ 请把稿件按句拆开,逐句给我: 1. 这一句观众应该看到什么画面? 2. 归类:A=我可以实拍 / B=可以 AI 生成 / C=用大字卡或示意图代替 3. 归到 B 的,给我一句可直接用的生成提示词(写清主体、动作、镜头、光线、风格) 4. 归到 A 的,告诉我拍摄要点(角度、时长、需要注意什么) 5. **特别标出哪些画面绝对不能用 AI 生成**——比如涉及产品实际效果、真实数据、真实人物、医疗健康的内容。 最后统计一下:AI 生成片段占全片多少比例比较合适?太多了会不会显得假?
卡住了怎么办拆不出画面——把每一句都问一遍「这句话在说什么画面」,说不出的就归到 C 类用大字卡。
2
生成片段:一次生成多个,挑着用
约 15 分钟AI 视频的合格率不高,不要指望一次就对。同一条提示词多生成几条,挑最自然的那个,比反复改提示词效率高。
同类备选:CapCut
- 每条提示词一次生成 3-4 条,挑一条用。
- 单个片段控制在 3-5 秒,长了容易崩。
- 检查三处:画面有没有变形、动作是否连贯、有没有奇怪的文字出现。
- 生成的是「辅助画面」,不要给太长镜头。
可直接套用的提示词
我要用 AI 生成几个视频片段来配合口播,请给我可以直接复制使用的提示词。 需要的画面(按上一轮的清单): 1. ______ 2. ______ 3. ______ 目标整体风格:______(写实/插画/电影感/极简) 画面比例:______(竖屏 9:16 / 横屏 16:9) 每条画面请给我: - 一句完整提示词(写清:主体 + 动作 + 镜头运动 + 光线 + 风格 + 画面比例) - 一个「负面提示」版本(避免出现什么:文字、变形、多余手指、水印) - 如果生成效果不好,可以微调哪一个变量?(给我 2 个替换方向) 另外告诉我: - 这类画面最适合用「文生视频」还是「图生视频」?为什么? - 竖屏生成和横屏生成,提示词写法有区别吗?
卡住了怎么办生成效果始终很怪——改用「图生视频」:先用图片工具生成一张满意的静帧,再让它动起来。
3
混进实拍里:让 AI 片段「不显眼」
约 5 分钟AI 片段最怕「显眼」。一旦观众看出「这段是假的」,前面建立的信任会一起打折。所以要用短、要衔接、要调色统一。
- AI 片段单个镜头不超过 3 秒,切得比实拍稍快一点。
- 和实拍做调色统一,色温、对比尽量靠拢。
- AI 画面期间口播不要停,让观众注意力在信息上。
- 涉及真实的画面坚持实拍;AI 只负责「比喻」和「氛围」。
可直接套用的提示词
我要把 AI 生成的片段和实拍素材剪到一起,请给我混剪方案。 实拍素材:______ AI 生成片段:______(几个、分别是什么内容) 口播总时长:______ 秒 请给我: 1. 一个剪辑顺序表:第几秒到第几秒,用实拍还是 AI 片段。 2. AI 片段放在哪些位置最不容易被发现是生成的?(例如转场处、说到抽象概念时) 3. 怎么让 AI 片段和实拍「接得上」?给具体做法(调色、运动方向、转场方式)。 4. AI 片段时长控制在多少秒以内比较安全? 5. 有哪些「一看就是 AI」的特征,我要主动避免? 6. 加不加「画面为 AI 生成」的说明?什么情况下必须加? 注意:我的目标是让观众专注内容,不是展示 AI 技术。
卡住了怎么办接得不顺——在两个片段之间插半秒黑场或纯色,比硬切自然。
常见坑
- 用 AI 生成画面冒充真实产品效果,涉嫌虚假宣传。
- AI 片段给太长,一眼被看出是生成的,反而掉信任。
- 生成效果不好就反复改提示词,不试试多生成几条。
- AI 片段和实拍色调完全不统一,剪在一起很跳。
- 涉及真实数据、真实人物的画面也交给 AI 生成。
- 全片都是 AI 生成,没有任何实拍,显得空。
常见问题
AI 生成的视频能直接用吗?
能,但只能当「辅助画面」。解释抽象概念、营造氛围可以用;产品实际效果、真实数据、真实场景绝对不能用——那叫虚假宣传。
为什么我生成的视频总是很怪?
多半是提示词太长、动作太复杂。一句话只写一个动作、一个镜头,生成质量立刻提升。另外单个片段控制在 3-5 秒,长了容易崩。
文生视频和图生视频,用哪个?
追求可控就用图生视频。先让图片工具生成一张满意的静帧,再让它动起来,画面构图你能提前看到,比纯文字描述靠谱得多。
