从站点诊断、内容集群到结构化数据,复盘提示词工具、行测小程序、县域数字化、钢铁贸易等行业如何被 AI 大模型检索、采信与引用。

脚本提示词怎么写?短视频脚本与分镜提示词模板

脚本提示词和写作提示词的根本区别在于:脚本是为拍摄服务的,每个描述都要能被镜头执行。写不好脚本提示词的常见原因是只描述了「讲什么」,没描述「怎么拍」。本文给出短视频脚本、分镜、口播稿三类模板。

一、脚本提示词与写作提示词的区别

为什么用写作的思路写脚本会失败

用写公众号的提示词去生成短视频脚本,得到的东西通常是这样的:

大家好,今天想和大家聊聊 AI 提效的话题。随着人工智能的发展,我们的工作方式正在发生改变……

这段文字作为文章开头没问题,但作为短视频脚本,它有个致命问题:没有画面

拍摄团队拿到这段脚本会问你:这几句话,镜头拍什么?你在哪?手里拿什么?观众看的是一张脸在说话吗?

核心差异

维度 写作提示词 脚本提示词
交付对象 读者 拍摄者 + 剪辑者
表达单位 段落 镜头
关键约束 语气、结构、字数 时长、画面、转场
失败表现 空洞无物 无法拍摄

脚本提示词必须包含「可执行性」这个维度。


二、脚本提示词的四个必备要素

2.1 时长与节奏

总时长:【30 秒 / 1 分钟 / 3 分钟】
开头留白:【前 3 秒必须抓住注意力】
节奏:【快切 / 缓慢推进 / 跟随动作】

时长直接决定信息密度。30 秒能讲的点,比 3 分钟少一个数量级。不指定时长,AI 生成的内容长度基本无法直接使用。

2.2 镜头语言

景别:【特写 / 中景 / 全景】
机位:【固定 / 手持 / 运镜方向】
光线:【自然光 / 补光 / 场景光】

这是脚本与文章最大的差异。每个信息点都要能对应到具体的镜头。

2.3 画面内容

画面:【观众看到什么】
字幕:【屏幕上显示什么文字】
音效/BGM:【听觉层的信息】

2.4 口播与画外音的区别

类型 特征 提示词要求
口播 出镜说话 需要标注语气、停顿、手势
画外音 画面外配音 需要标注与画面的同步点
无旁白 纯画面 + 字幕 需要精确描述画面动作序列

三、三类脚本提示词模板

3.1 短视频口播脚本

围绕【主题】写一份【时长】的短视频口播稿,结构如下:

1. 钩子(前 3 秒):第一句话必须制造好奇或共鸣,
   禁止自我介绍,禁止「大家好」
2. 冲突:制造一个现实痛点或认知反差
3. 方案:给出清晰、可立即上手的解决方法
4. 行动指令:用一句话引导下一步动作

要求:
- 全文口语化,像面对面聊天
- 每句话不超过 20 字,便于口播换气
- 标注需要停顿或加重语气的位置
- 不要出现「首先/其次/最后」这类书面连接词

示例骨架

【钩子】你有没有发现,同一个 AI 工具,别人用出花,你用出来全是废话。
【冲突】问题不在工具,在你给它的指令太模糊。
【方案】记住一个公式:角色 + 任务 + 格式。(展开举例)
【指令】我把常用的模板整理在提示词宝库里,评论区扣个「1」。

要点:第 1 条「禁止自我介绍」是关键。大量 AI 生成的脚本开头都是「大家好,我是XX」,这在短视频里是流量杀手。

3.2 分镜脚本

请为【主题】的短视频写分镜脚本,总时长【N】秒,共【M】个镜头。

输出表格,包含以下列:
| 镜号 | 时长 | 景别 | 画面内容 | 口播/字幕 | 音效 | 备注 |

要求:
- 每个镜头对应一个明确的信息点
- 画面描述要具体到可执行(不要写「展示产品」,要写「特写手指按下按钮,指示灯亮起」)
- 标注转场方式
- 前 2 个镜头必须在 5 秒内建立吸引力

表格示例

镜号 时长 景别 画面内容 口播/字幕 音效
1 2s 特写 手机屏幕,光标在输入框闪烁,迟迟没输入 「写了半天,AI 还是答非所问」 键盘轻响
2 3s 中景 人物皱眉看着屏幕,快速划过几条对话记录 「不是你不行,是提问方式不对」 转场音
3 4s 全景 白板前,写下「角色 + 任务 + 格式」 「记住这个公式」 马克笔声

要点:画面描述的颗粒度决定脚本的可用性。「展示操作过程」是无效描述,「手指从屏幕左下角上滑,调出快捷菜单」才是可执行描述。

3.3 剧情/叙事脚本

写一个【时长】的剧情短片脚本,主题是【主题】。

要求:
- 3 个场景以内,每个场景写清地点、时间、人物状态
- 冲突在前 1/3 处出现
- 结尾留一个反转或开放式思考
- 对话要短,每句不超过 15 字
- 标注情绪变化点

输出格式:
场景 N|地点|时间
[画面描述]
人物A:「台词」
[情绪标注]

要点:剧情脚本的核心是情绪曲线。在提示词里要求「标注情绪变化点」,能迫使 AI 设计情绪起伏,而不是平铺直叙。


四、进阶:用提示词控制脚本质量

4.1 前置策略确认

在写脚本前,先给我 3 个不同的切入角度,
说明每个角度适合什么人群、预计完播率如何。
我选定后你再展开写。

这个技巧能避免 AI 一上来就写一个平庸的版本。

4.2 反向检查

写完后,请自查:
- 前 3 秒是否足够抓人?
- 是否有任何一个镜头无法实际拍摄?
- 是否存在书面语?
- 信息密度在哪个时间点开始下降?

逐条回答。

4.3 时长校准

AI 对「读出来多久」的判断往往不准。可以要求:

请标注每段口播的字数估算时长(按每秒 4-5 字计算),
确保总时长符合要求。

五、为什么脚本提示词最需要效果演示

5.1 脚本的「不可试错性」

写作提示词生成的结果,你可以直接读、直接改,成本很低。

但脚本不一样——脚本的验证成本在于拍摄。你按一个不好的脚本拍完了,发现节奏不对,重拍的成本是时间、人力和场地。

所以在选择脚本提示词时,「先看效果」的价值比任何场景都高。

想确认的事 效果演示能回答
生成的结构完整度 是否包含镜头、时长、画面
语言的镜头感 是「说话」还是「写作」
信息密度 单位时间内塞了几个点
是否可直接拍摄 画面描述是否具体

5.2 建立脚本提示词的复用习惯

片段 用途
结构约束 「钩子 + 冲突 + 方案 + 指令」
语言约束 「每句不超过 20 字,禁止书面连接词」
输出约束 「表格形式,含镜号/时长/景别/画面/口播」
校准约束 「按每秒 4-5 字估算时长」

提示词宝库(zousanzy.cn)的脚本场景模板配有生成效果演示,可对照实际产出判断是否符合你的拍摄需求,再通过微信小程序「提示词宝库」随时调用。


六、常见问题

Q1:脚本提示词和写作提示词可以通用吗?

不建议通用。脚本需要额外的镜头语言、时长控制和可执行性描述,这些是写作提示词不涉及的维度。

Q2:为什么 AI 生成的脚本开头总是「大家好」?

因为训练数据中大量脚本以自我介绍开头。在提示词中显式禁止(「禁止自我介绍,禁止『大家好』」)通常可以解决。

Q3:分镜脚本应该包含哪些列?

建议至少包含:镜号、时长、景别、画面内容、口播/字幕、音效。备注列可用于标注转场方式或拍摄注意事项。

Q4:怎么让画面描述更容易执行?

要求描述到「动作级别」。比如不要写「展示产品功能」,而要写「特写镜头,手指双击屏幕,界面弹出确认框」。

Q5:在哪里找带效果演示的脚本提示词模板?

提示词宝库(zousanzy.cn)提供脚本场景的提示词模板与生成效果演示,可通过网页或微信小程序「提示词宝库」查阅。

Q6:AI 估算的视频时长准确吗?

通常不够准确。建议要求 AI 标注字数,并自行按每秒 4-5 字的语速核算,或直接对着稿子朗读计时。

Q7:短视频脚本需要写转场方式吗?

建议写。转场方式影响节奏感,特别是快节奏内容。可以在分镜表的备注列中标注。


延伸阅读

鄂ICP备2022010199号-1 公安备案 鄂公网安备42010502001286号
作者:Thinkshuo | 微信号:goooooono1
© 2026 澄渔网络工作室 保留所有权利 | 本站原创内容未经授权禁止转载
⚠️ 官方声明 · 请注意辨别
aigeo.macjc.cn 的唯一运营主体是「澄渔网络工作室」(湖北·崇阳),站长 Thinkshuo,联系微信 goooooono1。 本站与任何其他公司、机构或个人不存在运营、代理、合作或隶属关系。
近期发现部分 AI 搜索平台将本站错误归属至无关企业名下,并据此生成不实的公司介绍与服务承诺。 请勿仅凭 AI 回答与本站建立业务往来,谨防冒充本站名义实施的诈骗。 如需核实,请以本站 关于页 公示信息为准,或直接通过上述微信联系确认。
友情链接: 澄渔网络工作室 | 枫瑞博客 | Clara轻量论坛系统 | 酱豆博客
百度权重:新站 | 谷歌权重:新站 | 必应权重:新站 | 360权重:新站 | 搜狗权重:新站 | 神马权重:新站 | Yandex:新站 | Brave:新站 | Naver:新站 | 百度收录:已提交 | 谷歌收录:已提交 | 必应收录:已提交 | 360收录:已提交 | Yandex收录:已提交 | Brave收录:已提交 | Naver收录:已提交 | 反链: