制作知识视频,可以把任务拆成六步:搜集 → 编排 → 找图 → 定样式与写分镜 → 检查修改 → 直出。每一步先产出可检查的文件,确认后再进入下一步。
本文根据截图整理。截图中的“定样式”和“写分镜”都标为第四步,因此合并为第四步的两个子环节;第五步按“检查修改”补充,相关提示词为补充模板。其余提示词保留截图中的主要内容,并调整换行,方便复制。
流程与文件准备
| 步骤 | 要做的事 | 产出或检查点 |
|---|---|---|
| 第一步:搜集 | 搜索资料,核对事实,整理知识文章 | 文章.md,附来源链接 |
| 第二步:编排 | 把文章改成一幕一幕的视频文案 | 文案.md |
| 第三步:找图 | 为每幕寻找素材,记录来源与许可 | 找图.md、素材/ |
| 第四步:定样式与写分镜 | 先选样图,再确定画面、时长与动效 | 三张样图、分镜.md |
| 第五步:检查修改 | 核对文案、素材、分镜与节奏 | 修订后的文件 |
| 第六步:直出 | 先做开头 10 秒,确认后制作整片 | 预览 MP4、完整 MP4 |
开始前,准备一个项目文件夹。下面是文件组织示例,文件会随着流程逐步产生:
知识视频项目/
├── 文章.md
├── 文案.md
├── 找图.md
├── 分镜.md
├── bgm.mp3
├── 素材/
│ ├── 01-开场.png
│ ├── 02-历史照片.png
│ └── 03-深蓝.png
└── 输出/
├── 开头10秒.mp4
└── 完整视频.mp4
下面以“人工智能的发展简史”为例。实际使用时,统一替换主题、文件名、视频时长、画幅方向、所选风格和配乐文件名。
第一步:搜集资料,整理知识文章
这一阶段先把知识讲准确。发展史类主题可以选取关键节点,每个节点写清年份、人物、事件与意义,并附上可核对的来源。
提示词:
<role>
你是知识科普作者,最在意事实准确。
</role>
<task>
上网搜「人工智能的发展简史」,挑 8 到 10 个关键节点,
每个写清哪一年、谁、做了什么、为什么重要。
整理成一篇知识文章,存成 文章.md。
</task>
<check>
年份、人名、数字、原话都要有出处,链接写在每段后面;
找不到可靠出处的节点删掉。
</check>
按主题调整:
- 把“人工智能的发展简史”换成自己的知识点,例如“为什么天空是蓝的”。
- 如果讲的是原理,把“挑 8 到 10 个关键节点”换成“拆成 5 到 8 个要讲清楚的点”。
拿到文章后,打开来源链接,重点核对年份、人物、数字和直接引语。已有可靠笔记时,也可以直接用自己的笔记进入第二步。
第二步:编排成视频文案
知识文章要进一步改成适合观看的短句。先说明时长、横竖屏和是否有旁白,再让 AI 按幕编排。
提示词:
<role>
你是抖音知识视频的编剧,擅长把复杂的事讲给完全不懂的人听。
</role>
<context>
这篇要做成 2 分钟左右的横屏视频,没有旁白,
观众只看画面上的字配音乐,所以每句话都要短、一看就懂。
</context>
<task>
把 文章.md 改成视频文案,存成 文案.md,分成一幕一幕:
开头先抛一个问题让观众猜;
中间当故事讲,用至少一个生活里的比方,安排一次反转;
结尾落到普通人身上。
</task>
<avoid>
不解释就用专业术语;一屏超过 20 个字;文章.md 里没有的事实。
</avoid>
按发布形式调整:
- 时长按内容确定;如果发布竖屏视频,把“横屏”换成“竖屏”。
- 如果自己配音,把“没有旁白”换成“有旁白,字跟着旁白走”。
文章.md可以替换为自己已经写好的笔记文件。
写完最好自己读一遍,检查开头是否能引起兴趣,句子是否容易理解,反转是否符合事实。比喻应帮助理解;文案里新增的事实要回到资料阶段核验。
第三步:找图并整理素材
为每一幕配一张能支持内容的图,例如历史照片、论文首页或机器实物图。让 AI 给出具体网址和截图位置,自己打开网页保存素材。
提示词:
<context>
视频不能只有字,每一幕都要有一张真实的图
(老照片、论文首页、机器的样子),看起来才不干巴。
图我自己去网页上截。
</context>
<task>
按 文案.md 一幕一幕列出要用的图:
在哪个网址、截网页上的哪一块、用在第几幕,存成 找图.md。
</task>
<avoid>
标着版权所有、来路不明的图。
优先用公有领域、自由许可的,每张写清出处和许可。
</avoid>
按素材需求调整:
- 把“老照片、论文首页、机器的样子”换成该主题适合的图,例如“光谱图、日落照片”。
- 如果使用生图工具,把“图我自己去网页上截”换成“图我用生图工具出,你写清每幕要什么”。生成的示意图应与真实历史素材区分,不能当作史料使用。
截好的图放进 素材/ 文件夹,文件名用幕号开头,例如 03-深蓝.png。在 找图.md 中保留文件名、来源链接、许可和所需署名;截图本身不会改变原素材的使用许可。
第四步:先定样式,再写分镜
4.1 定样式:先看三个方案
先用开头同一幕做三张风格差异明显的样图,选定一个方向后,再扩展到整片。
提示词:
<task>
素材文件夹里是我截好的图。这条视频用 HyperFrames 来做。
先给我 3 个差别大的画面风格,
每个用开头那一幕做一张 1920×1080 的样图,
各说一句为什么适合。先别往下做,等我选。
</task>
<avoid>
深色背景配霓虹光;字都堆在正中间;紫色渐变;
所有东西都淡入淡出。
</avoid>
<avoid> 中写自己不想要的效果,也可以补充“不要卡通人物”等要求。竖屏视频的样图尺寸应改成 1080×1920。
选样图时,重点看文字是否清楚、图文关系是否明确、风格是否适合主题。选好后,记录风格编号,例如 A、B 或 C。
4.2 写分镜:明确每个镜头怎么做
分镜需要把文案和素材落实到时间线上:每个镜头多长、出现什么字、用哪张图、如何运动,以及何时切换。
提示词:
<role>
你是动效导演,最在意节奏。
</role>
<task>
用 C 这个风格,写分镜脚本 分镜.md:
每个镜头写几秒、画面、字、用哪张图、怎么动。
截图要处理成这个风格的样子,别直接贴上去。
配乐是文件夹里的 bgm.mp3,先找出拍子,镜头切换卡在拍子上。
写完先停,等我检查。
</task>
<specs>
横屏 1920×1080,每秒 30 帧,总长跟着文案走。
</specs>
把 C 换成选中的风格,把 bgm.mp3 换成实际配乐文件名。竖屏时改成“竖屏 1080×1920”,并与文案、样图保持一致。
截图的风格处理可以包括裁切、边框、配色和标注,但要保留关键内容。若当前工具无法分析配乐,应先说明能力限制,再提供可调整的切换时间,不能假装已经找到了拍点。
第五步:检查修改
这一阶段检查文章、文案、素材和分镜是否一致,把问题落实到具体幕号再修改。下面的提示词是根据流程补充的检查模板。
检查与修改提示词(补充):
<role>
你是知识视频的审稿与分镜检查编辑,
重点检查事实准确、表达清楚、素材对应和节奏合理。
</role>
<task>
对照 文章.md、文案.md、找图.md、分镜.md 和素材文件夹,
逐幕检查,先列出具体问题,再修改对应文件。
每个问题写清:幕号、问题、修改建议。
涉及事实的修改要附可靠来源,无法核实的内容标出并删除或改写。
修改后说明改了哪些地方,先停在分镜阶段,等我确认。
</task>
<check>
1. 年份、人名、数字、引语是否有可靠出处;文案有没有新增未经核实的事实。
2. 开头问题是否清楚;专业术语是否解释;比喻和反转是否准确。
3. 无旁白版本是否一屏不超过 20 个字;停留时间是否足够读完。
4. 每幕图片是否对应内容;文件是否存在;出处、许可和署名是否齐全。
5. 分镜是否写清时长、画面、文字、素材文件名和动效。
6. 所有镜头时长相加是否符合目标时长;切换点是否与已确认的配乐拍点对应。
7. 横竖屏、分辨率、帧率和所选风格是否统一。
</check>
<avoid>
凭空补事实;为了反转夸大结论;未确认分镜就制作整片。
</avoid>
人工检查时,也要按幕号给出具体反馈。例如“第 3 幕拆成两屏,每屏停留 3 秒”,或“第 5 幕换成 05-机器实物.png”。确认修订后的分镜,再进入渲染阶段。
第六步:直出,先做开头 10 秒
分镜确认后,先制作开头 10 秒,检查实际的文字大小、动效与音乐节奏。预览满意后再制作整片。
提示词:
<task>
分镜可以,照着做。先只做开头 10 秒,渲成 MP4 给我看,
我满意了再做整片。
</task>
<check>
做完自己抽几帧看:字有没有出框、重叠、太小;
年份和文案对不对;切换在不在拍子上。
有问题改完再给我。
</check>
看预览时,抽帧检查排版,并连续播放检查阅读时间、转场和音乐同步。若有问题,按时间点反馈,例如“第 6 秒的文字太小,放大并延长停留时间”。
开头确认后的继续制作提示词如下,为补充模板:
<task>
开头 10 秒确认通过。按已确认的风格和修订后的 分镜.md 制作整片,
保持相同的画幅、分辨率和帧率,导出完整 MP4 到输出文件夹。
</task>
<check>
逐幕抽帧检查文字出框、重叠、过小和素材对应问题;
完整播放检查阅读时间、镜头切换、配乐同步与结尾是否完整。
核对年份、文案和总时长,有问题修正后再交付。
</check>