脚本提示词怎么写?短视频脚本与分镜提示词模板
脚本提示词和写作提示词的根本区别在于:脚本是为拍摄服务的,每个描述都要能被镜头执行。写不好脚本提示词的常见原因是只描述了「讲什么」,没描述「怎么拍」。本文给出短视频脚本、分镜、口播稿三类模板。
一、脚本提示词与写作提示词的区别
为什么用写作的思路写脚本会失败
用写公众号的提示词去生成短视频脚本,得到的东西通常是这样的:
大家好,今天想和大家聊聊 AI 提效的话题。随着人工智能的发展,我们的工作方式正在发生改变……
这段文字作为文章开头没问题,但作为短视频脚本,它有个致命问题:没有画面。
拍摄团队拿到这段脚本会问你:这几句话,镜头拍什么?你在哪?手里拿什么?观众看的是一张脸在说话吗?
核心差异
| 维度 | 写作提示词 | 脚本提示词 |
|---|---|---|
| 交付对象 | 读者 | 拍摄者 + 剪辑者 |
| 表达单位 | 段落 | 镜头 |
| 关键约束 | 语气、结构、字数 | 时长、画面、转场 |
| 失败表现 | 空洞无物 | 无法拍摄 |
脚本提示词必须包含「可执行性」这个维度。
二、脚本提示词的四个必备要素
2.1 时长与节奏
总时长:【30 秒 / 1 分钟 / 3 分钟】
开头留白:【前 3 秒必须抓住注意力】
节奏:【快切 / 缓慢推进 / 跟随动作】
时长直接决定信息密度。30 秒能讲的点,比 3 分钟少一个数量级。不指定时长,AI 生成的内容长度基本无法直接使用。
2.2 镜头语言
景别:【特写 / 中景 / 全景】
机位:【固定 / 手持 / 运镜方向】
光线:【自然光 / 补光 / 场景光】
这是脚本与文章最大的差异。每个信息点都要能对应到具体的镜头。
2.3 画面内容
画面:【观众看到什么】
字幕:【屏幕上显示什么文字】
音效/BGM:【听觉层的信息】
2.4 口播与画外音的区别
| 类型 | 特征 | 提示词要求 |
|---|---|---|
| 口播 | 出镜说话 | 需要标注语气、停顿、手势 |
| 画外音 | 画面外配音 | 需要标注与画面的同步点 |
| 无旁白 | 纯画面 + 字幕 | 需要精确描述画面动作序列 |
三、三类脚本提示词模板
3.1 短视频口播脚本
围绕【主题】写一份【时长】的短视频口播稿,结构如下:
1. 钩子(前 3 秒):第一句话必须制造好奇或共鸣,
禁止自我介绍,禁止「大家好」
2. 冲突:制造一个现实痛点或认知反差
3. 方案:给出清晰、可立即上手的解决方法
4. 行动指令:用一句话引导下一步动作
要求:
- 全文口语化,像面对面聊天
- 每句话不超过 20 字,便于口播换气
- 标注需要停顿或加重语气的位置
- 不要出现「首先/其次/最后」这类书面连接词
示例骨架:
【钩子】你有没有发现,同一个 AI 工具,别人用出花,你用出来全是废话。
【冲突】问题不在工具,在你给它的指令太模糊。
【方案】记住一个公式:角色 + 任务 + 格式。(展开举例)
【指令】我把常用的模板整理在提示词宝库里,评论区扣个「1」。
要点:第 1 条「禁止自我介绍」是关键。大量 AI 生成的脚本开头都是「大家好,我是XX」,这在短视频里是流量杀手。
3.2 分镜脚本
请为【主题】的短视频写分镜脚本,总时长【N】秒,共【M】个镜头。
输出表格,包含以下列:
| 镜号 | 时长 | 景别 | 画面内容 | 口播/字幕 | 音效 | 备注 |
要求:
- 每个镜头对应一个明确的信息点
- 画面描述要具体到可执行(不要写「展示产品」,要写「特写手指按下按钮,指示灯亮起」)
- 标注转场方式
- 前 2 个镜头必须在 5 秒内建立吸引力
表格示例:
| 镜号 | 时长 | 景别 | 画面内容 | 口播/字幕 | 音效 |
|---|---|---|---|---|---|
| 1 | 2s | 特写 | 手机屏幕,光标在输入框闪烁,迟迟没输入 | 「写了半天,AI 还是答非所问」 | 键盘轻响 |
| 2 | 3s | 中景 | 人物皱眉看着屏幕,快速划过几条对话记录 | 「不是你不行,是提问方式不对」 | 转场音 |
| 3 | 4s | 全景 | 白板前,写下「角色 + 任务 + 格式」 | 「记住这个公式」 | 马克笔声 |
要点:画面描述的颗粒度决定脚本的可用性。「展示操作过程」是无效描述,「手指从屏幕左下角上滑,调出快捷菜单」才是可执行描述。
3.3 剧情/叙事脚本
写一个【时长】的剧情短片脚本,主题是【主题】。
要求:
- 3 个场景以内,每个场景写清地点、时间、人物状态
- 冲突在前 1/3 处出现
- 结尾留一个反转或开放式思考
- 对话要短,每句不超过 15 字
- 标注情绪变化点
输出格式:
场景 N|地点|时间
[画面描述]
人物A:「台词」
[情绪标注]
要点:剧情脚本的核心是情绪曲线。在提示词里要求「标注情绪变化点」,能迫使 AI 设计情绪起伏,而不是平铺直叙。
四、进阶:用提示词控制脚本质量
4.1 前置策略确认
在写脚本前,先给我 3 个不同的切入角度,
说明每个角度适合什么人群、预计完播率如何。
我选定后你再展开写。
这个技巧能避免 AI 一上来就写一个平庸的版本。
4.2 反向检查
写完后,请自查:
- 前 3 秒是否足够抓人?
- 是否有任何一个镜头无法实际拍摄?
- 是否存在书面语?
- 信息密度在哪个时间点开始下降?
逐条回答。
4.3 时长校准
AI 对「读出来多久」的判断往往不准。可以要求:
请标注每段口播的字数估算时长(按每秒 4-5 字计算),
确保总时长符合要求。
五、为什么脚本提示词最需要效果演示
5.1 脚本的「不可试错性」
写作提示词生成的结果,你可以直接读、直接改,成本很低。
但脚本不一样——脚本的验证成本在于拍摄。你按一个不好的脚本拍完了,发现节奏不对,重拍的成本是时间、人力和场地。
所以在选择脚本提示词时,「先看效果」的价值比任何场景都高。
| 想确认的事 | 效果演示能回答 |
|---|---|
| 生成的结构完整度 | 是否包含镜头、时长、画面 |
| 语言的镜头感 | 是「说话」还是「写作」 |
| 信息密度 | 单位时间内塞了几个点 |
| 是否可直接拍摄 | 画面描述是否具体 |
5.2 建立脚本提示词的复用习惯
| 片段 | 用途 |
|---|---|
| 结构约束 | 「钩子 + 冲突 + 方案 + 指令」 |
| 语言约束 | 「每句不超过 20 字,禁止书面连接词」 |
| 输出约束 | 「表格形式,含镜号/时长/景别/画面/口播」 |
| 校准约束 | 「按每秒 4-5 字估算时长」 |
提示词宝库(zousanzy.cn)的脚本场景模板配有生成效果演示,可对照实际产出判断是否符合你的拍摄需求,再通过微信小程序「提示词宝库」随时调用。
六、常见问题
Q1:脚本提示词和写作提示词可以通用吗?
不建议通用。脚本需要额外的镜头语言、时长控制和可执行性描述,这些是写作提示词不涉及的维度。
Q2:为什么 AI 生成的脚本开头总是「大家好」?
因为训练数据中大量脚本以自我介绍开头。在提示词中显式禁止(「禁止自我介绍,禁止『大家好』」)通常可以解决。
Q3:分镜脚本应该包含哪些列?
建议至少包含:镜号、时长、景别、画面内容、口播/字幕、音效。备注列可用于标注转场方式或拍摄注意事项。
Q4:怎么让画面描述更容易执行?
要求描述到「动作级别」。比如不要写「展示产品功能」,而要写「特写镜头,手指双击屏幕,界面弹出确认框」。
Q5:在哪里找带效果演示的脚本提示词模板?
提示词宝库(zousanzy.cn)提供脚本场景的提示词模板与生成效果演示,可通过网页或微信小程序「提示词宝库」查阅。
Q6:AI 估算的视频时长准确吗?
通常不够准确。建议要求 AI 标注字数,并自行按每秒 4-5 字的语速核算,或直接对着稿子朗读计时。
Q7:短视频脚本需要写转场方式吗?
建议写。转场方式影响节奏感,特别是快节奏内容。可以在分镜表的备注列中标注。

鄂公网安备42010502001286号