安装方式
手动下载安装
下载 ZIP 后解压到技能目录即可安装。若在桌面客户端 WebView中直接下载出现异常,本站会改为提示页 + 原始链接,请按页内说明操作。
下载 ZIP (kqb-ai-video-batch-production-v1.0.0.zip)使用指南
AI批量短视频生产工作流 v1.0
基于知识类博主实战复盘的方法论,从选题到分发全流程AI辅助,一周产出10条短视频。
适用场景
- ✅ 知识科普、观点输出、案例拆解、干货分享类内容
- ✅ 已有明确账号定位和知识体系
- ✅ 有历史素材(用户提问、文章、评论区)可喂给AI
- ✅ 内容对画面要求非"电影级质感"
- ❌ 不适合Vlog、颜值、探店等强个人实拍属性内容
完整工作流
选题挖掘 → 脚本生成 → 画面素材 → 声音克隆 → 剪辑合成 → 批量分发
跑通后,单条视频人工投入约1.5小时(第3天起),10条总耗时8-10小时(原来55-85小时)。
第一步:选题挖掘 — 把"拍什么"扔给AI
前置准备
整理一份素材文档喂给AI:
- 过去用户在知乎/公众号/评论区提出的100+问题
- 自己过去写过的爆款文章/笔记的主题
- 竞品近期高赞内容的话题方向
AI指令模板
你现在是一个短视频编导。以下是目标用户向我提问过的问题列表:
【粘贴问题列表】
我的目标用户画像:【描述用户画像】
我的账号定位:【描述账号定位】
我的内容赛道:【描述赛道】
请帮我分析:哪些问题可以拍成1分钟以内的知识类短视频?
按"大概率能火""值得一试""一般"三档分类,每类给出选题,并说明为什么。
关键要点
- 必须附带用户画像和已有素材,否则结果会非常通用、很水
- AI往往能把一些被忽视的问题排到"大概率能火"档(它发现了情绪热点+知识缺口的交叉点)
- 从18个左右的候选选题中选10个,作为一周发布计划
第二步:脚本生成 — 结构化输出是关键
AI指令模板
请为以下选题撰写短视频脚本,时长50-60秒:
【选题内容】
要求:
1. 开头黄金5秒:必须制造悬念/反常识/引发共鸣
2. 中间45秒:分3个要点讲清核心逻辑,每点带一个生活化例子
3. 结尾10秒:总结+引导互动(给一个具体的提问方向)
4. 整体口语化,像朋友聊天,不用书面语
5. 标注每一秒段的大致时长
6. 禁止使用"首先其次最后""总而言之""值得注意的是"等过渡词,用"你想想""说白了""举个例子"来代替
7. 禁止使用极端词:最、第一、顶级、极致、全网最优、完全有效
去AI味的核心技巧
加一句指令即可大幅提升口语感:
"禁止使用'首先其次最后''总而言之''值得注意的是'等过渡词,用'你想想''说白了''举个例子'来代替。"
脚本输出格式参考
【0-5秒】钩子:{悬念/反常识/共鸣句}
【5-20秒】要点1:{核心逻辑} + 例子:{生活化场景}
【20-35秒】要点2:{核心逻辑} + 例子:{生活化场景}
【35-50秒】要点3:{核心逻辑} + 例子:{生活化场景}
【50-60秒】结尾:{一句话总结} + 互动引导
第三步:画面素材 — AI生成+素材库组合
双轨策略
| 画面类型 | 方案 | 工具 | |---------|------|------| | 抽象概念/比喻类 | AI生成图片 | Midjourney / DALL-E / 可灵等 | | 具体实物/场景类 | 版权素材库+B-roll | Pexels / Pixabay / 自拍 |
AI生成画面技巧
- 生成静态图(比生成视频快得多)
- 在剪辑中做Ken Burns效果(缩放+平移),既有动态感又省时间
- 示例:讲"为什么越省钱越穷"→ 生成"人推着一辆不断漏水的购物车"
⚠️ 关键注意事项
- 风格统一:固定一套风格描述词,每条视频复用,避免画风大杂烩
- 画面匹配:每一段画面必须对应脚本关键词,不能随便配
- 风格词示例:
"扁平插画风格,柔和色彩,简洁构图,白色背景,无文字"
第四步:声音克隆 — 用AI克隆自己的声音
前期准备
- 准备1-3分钟自己的原声录音
- 不用播音腔,正常聊天说话即可
- 环境安静,无杂音、无背景音乐
- 手机直接录音就够用
- 越自然,克隆出来越像本人
操作步骤
- 打开支持声音克隆的AI配音工具(如剪映/火山引擎/ ElevenLabs等)
- 上传原声素材,等待系统训练音色(通常几十秒)
- 调整语速、语调、情绪参数
- 粘贴脚本,一键生成语音
⚠️ 常见坑及解法
问题:AI读出来的声音节奏像新闻播报,情绪太平
解法:在脚本里加入大量口语标记
(停顿一下)(语气加重)(稍微放慢)(带点笑意)(反问语气)
第五步:剪辑合成 — 模板化+批量操作
工具选择
剪映Pro(或CapCut),核心是模板化。
预制标准模板
模板里固定以下元素:
- ✅ 固定的片头片尾(3-5秒)
- ✅ 固定的字幕样式和位置
- ✅ 固定的BGM(选3首轮换)
- ✅ 固定的转场效果
- ✅ 固定的画面比例(9:16竖屏)
- ✅ 固定的文字排版样式
每条新视频只需三步
- 替换配音(拖入AI生成的音频)
- 替换画面素材(按脚本关键词对应)
- 微调时间轴(根据配音长度对齐)
效率数据
- 首条视频:约1.5小时(搭建模板)
- 后续视频:15-20分钟/条
第六步:批量分发 — AI改写文案多平台适配
AI指令模板
请将以下视频的核心观点转写成不同平台的发布文案:
【粘贴脚本内容】
要求:
1. 抖音/快手版:短平快+强引导,控制在50字以内
2. 视频号版:偏观点+社交传播导向,60-80字
3. B站版:更完整的逻辑链+标题党优化,100-150字
4. 每个版本都要带#话题标签
5. 每个版本的语气和风格要符合平台调性
平台适配要点
| 平台 | 文案风格 | 核心策略 | |------|---------|---------| | 抖音/快手 | 短平快+强引导 | 制造好奇、引导互动 | | 视频号 | 偏观点+社交导向 | 金句、可转发、有共鸣 | | B站 | 完整逻辑+标题党 | 信息密度高、标题吸引点击 |
⚠️ 五大常见坑(必读)
坑1:AI生成的脚本不审核直接用
风险: AI可能编造看似专业但错误的数据/事实 解法: 必须加人工审核环节,尤其注意事实性内容、数据引用
坑2:声音克隆的情绪太平
风险: 像新闻播报,没有感染力 解法: 脚本中加入口语标记(停顿、加重、放慢等),调整情绪参数
坑3:画面和音频匹配度低
风险: 用户反馈"画面和说的好像没关系" 解法: 严格要求每一段画面对应脚本关键词,这一步不能省
坑4:AI生成画面风格不统一
风险: 不同提示词画出完全不同画风,拼在一起像大杂烩 解法: 统一固定风格描述词,每条视频复用
坑5:批量生产导致内容同质化
风险: 视频结构太像,用户会腻 解法: 在模板里设多个不同的开头模式轮换使用(悬念型/反常识型/共鸣型/提问型)
效率与效果参考
效率对比(10条视频)
| 指标 | 传统方式 | AI辅助 | |------|---------|--------| | 总耗时 | 55-85小时 | 8-10小时 | | 单条剪辑 | 1.5小时 | 15-20分钟 | | 日均人工投入 | — | 1.5小时(第3天起) |
效果参考(知识类博主,5万粉以下)
| 指标 | 数据 | |------|------| | 播放量增长 | +70% | | 最高单条播放 | 18.7万 | | 平均完播率 | 36%(之前27%) | | 周粉丝增长 | 4200+ |
使用本技能的标准流程
当用户触发此技能时,按以下顺序执行:
- 确认账号信息:询问用户的账号定位、内容赛道、目标用户画像
- 收集素材:让用户提供已有素材(用户提问、文章、爆款内容)
- 选题生成:用第一步的模板生成选题列表
- 脚本批量生产:用第二步的模板为每个选题生成脚本
- 画面方案规划:为每个脚本标注哪些用AI生成、哪些用素材库
- 配音指导:指导用户完成声音克隆和脚本口语标记
- 剪辑模板搭建:帮用户设计标准剪辑模板
- 分发文案生成:用第六步的模板生成全平台文案
如果用户只需要某个环节的帮助,直接跳到对应步骤执行即可。
# AI批量短视频生产工作流 v1.0
基于知识类博主实战复盘的方法论,从选题到分发全流程AI辅助,一周产出10条短视频。
## 适用场景
- ✅ 知识科普、观点输出、案例拆解、干货分享类内容
- ✅ 已有明确账号定位和知识体系
- ✅ 有历史素材(用户提问、文章、评论区)可喂给AI
- ✅ 内容对画面要求非"电影级质感"
- ❌ 不适合Vlog、颜值、探店等强个人实拍属性内容
## 完整工作流
```
选题挖掘 → 脚本生成 → 画面素材 → 声音克隆 → 剪辑合成 → 批量分发
```
跑通后,单条视频人工投入约1.5小时(第3天起),10条总耗时8-10小时(原来55-85小时)。
---
## 第一步:选题挖掘 — 把"拍什么"扔给AI
### 前置准备
整理一份素材文档喂给AI:
- 过去用户在知乎/公众号/评论区提出的100+问题
- 自己过去写过的爆款文章/笔记的主题
- 竞品近期高赞内容的话题方向
### AI指令模板
```
你现在是一个短视频编导。以下是目标用户向我提问过的问题列表:
【粘贴问题列表】
我的目标用户画像:【描述用户画像】
我的账号定位:【描述账号定位】
我的内容赛道:【描述赛道】
请帮我分析:哪些问题可以拍成1分钟以内的知识类短视频?
按"大概率能火""值得一试""一般"三档分类,每类给出选题,并说明为什么。
```
### 关键要点
- **必须附带用户画像和已有素材**,否则结果会非常通用、很水
- AI往往能把一些被忽视的问题排到"大概率能火"档(它发现了情绪热点+知识缺口的交叉点)
- 从18个左右的候选选题中选10个,作为一周发布计划
---
## 第二步:脚本生成 — 结构化输出是关键
### AI指令模板
```
请为以下选题撰写短视频脚本,时长50-60秒:
【选题内容】
要求:
1. 开头黄金5秒:必须制造悬念/反常识/引发共鸣
2. 中间45秒:分3个要点讲清核心逻辑,每点带一个生活化例子
3. 结尾10秒:总结+引导互动(给一个具体的提问方向)
4. 整体口语化,像朋友聊天,不用书面语
5. 标注每一秒段的大致时长
6. 禁止使用"首先其次最后""总而言之""值得注意的是"等过渡词,用"你想想""说白了""举个例子"来代替
7. 禁止使用极端词:最、第一、顶级、极致、全网最优、完全有效
```
### 去AI味的核心技巧
加一句指令即可大幅提升口语感:
> "禁止使用'首先其次最后''总而言之''值得注意的是'等过渡词,用'你想想''说白了''举个例子'来代替。"
### 脚本输出格式参考
```
【0-5秒】钩子:{悬念/反常识/共鸣句}
【5-20秒】要点1:{核心逻辑} + 例子:{生活化场景}
【20-35秒】要点2:{核心逻辑} + 例子:{生活化场景}
【35-50秒】要点3:{核心逻辑} + 例子:{生活化场景}
【50-60秒】结尾:{一句话总结} + 互动引导
```
---
## 第三步:画面素材 — AI生成+素材库组合
### 双轨策略
| 画面类型 | 方案 | 工具 |
|---------|------|------|
| 抽象概念/比喻类 | AI生成图片 | Midjourney / DALL-E / 可灵等 |
| 具体实物/场景类 | 版权素材库+B-roll | Pexels / Pixabay / 自拍 |
### AI生成画面技巧
- 生成静态图(比生成视频快得多)
- 在剪辑中做**Ken Burns效果**(缩放+平移),既有动态感又省时间
- 示例:讲"为什么越省钱越穷"→ 生成"人推着一辆不断漏水的购物车"
### ⚠️ 关键注意事项
- **风格统一**:固定一套风格描述词,每条视频复用,避免画风大杂烩
- **画面匹配**:每一段画面必须对应脚本关键词,不能随便配
- 风格词示例:`"扁平插画风格,柔和色彩,简洁构图,白色背景,无文字"`
---
## 第四步:声音克隆 — 用AI克隆自己的声音
### 前期准备
1. 准备1-3分钟自己的原声录音
2. 不用播音腔,正常聊天说话即可
3. 环境安静,无杂音、无背景音乐
4. 手机直接录音就够用
5. 越自然,克隆出来越像本人
### 操作步骤
1. 打开支持声音克隆的AI配音工具(如剪映/火山引擎/ ElevenLabs等)
2. 上传原声素材,等待系统训练音色(通常几十秒)
3. 调整语速、语调、情绪参数
4. 粘贴脚本,一键生成语音
### ⚠️ 常见坑及解法
**问题:AI读出来的声音节奏像新闻播报,情绪太平**
**解法:在脚本里加入大量口语标记**
- `(停顿一下)`
- `(语气加重)`
- `(稍微放慢)`
- `(带点笑意)`
- `(反问语气)`
---
## 第五步:剪辑合成 — 模板化+批量操作
### 工具选择
剪映Pro(或CapCut),核心是模板化。
### 预制标准模板
模板里固定以下元素:
- ✅ 固定的片头片尾(3-5秒)
- ✅ 固定的字幕样式和位置
- ✅ 固定的BGM(选3首轮换)
- ✅ 固定的转场效果
- ✅ 固定的画面比例(9:16竖屏)
- ✅ 固定的文字排版样式
### 每条新视频只需三步
1. **替换配音**(拖入AI生成的音频)
2. **替换画面素材**(按脚本关键词对应)
3. **微调时间轴**(根据配音长度对齐)
### 效率数据
- 首条视频:约1.5小时(搭建模板)
- 后续视频:15-20分钟/条
---
## 第六步:批量分发 — AI改写文案多平台适配
### AI指令模板
```
请将以下视频的核心观点转写成不同平台的发布文案:
【粘贴脚本内容】
要求:
1. 抖音/快手版:短平快+强引导,控制在50字以内
2. 视频号版:偏观点+社交传播导向,60-80字
3. B站版:更完整的逻辑链+标题党优化,100-150字
4. 每个版本都要带#话题标签
5. 每个版本的语气和风格要符合平台调性
```
### 平台适配要点
| 平台 | 文案风格 | 核心策略 |
|------|---------|---------|
| 抖音/快手 | 短平快+强引导 | 制造好奇、引导互动 |
| 视频号 | 偏观点+社交导向 | 金句、可转发、有共鸣 |
| B站 | 完整逻辑+标题党 | 信息密度高、标题吸引点击 |
---
## ⚠️ 五大常见坑(必读)
### 坑1:AI生成的脚本不审核直接用
**风险:** AI可能编造看似专业但错误的数据/事实
**解法:** 必须加人工审核环节,尤其注意事实性内容、数据引用
### 坑2:声音克隆的情绪太平
**风险:** 像新闻播报,没有感染力
**解法:** 脚本中加入口语标记(停顿、加重、放慢等),调整情绪参数
### 坑3:画面和音频匹配度低
**风险:** 用户反馈"画面和说的好像没关系"
**解法:** 严格要求每一段画面对应脚本关键词,这一步不能省
### 坑4:AI生成画面风格不统一
**风险:** 不同提示词画出完全不同画风,拼在一起像大杂烩
**解法:** 统一固定风格描述词,每条视频复用
### 坑5:批量生产导致内容同质化
**风险:** 视频结构太像,用户会腻
**解法:** 在模板里设多个不同的开头模式轮换使用(悬念型/反常识型/共鸣型/提问型)
---
## 效率与效果参考
### 效率对比(10条视频)
| 指标 | 传统方式 | AI辅助 |
|------|---------|--------|
| 总耗时 | 55-85小时 | 8-10小时 |
| 单条剪辑 | 1.5小时 | 15-20分钟 |
| 日均人工投入 | — | 1.5小时(第3天起) |
### 效果参考(知识类博主,5万粉以下)
| 指标 | 数据 |
|------|------|
| 播放量增长 | +70% |
| 最高单条播放 | 18.7万 |
| 平均完播率 | 36%(之前27%) |
| 周粉丝增长 | 4200+ |
---
## 使用本技能的标准流程
当用户触发此技能时,按以下顺序执行:
1. **确认账号信息**:询问用户的账号定位、内容赛道、目标用户画像
2. **收集素材**:让用户提供已有素材(用户提问、文章、爆款内容)
3. **选题生成**:用第一步的模板生成选题列表
4. **脚本批量生产**:用第二步的模板为每个选题生成脚本
5. **画面方案规划**:为每个脚本标注哪些用AI生成、哪些用素材库
6. **配音指导**:指导用户完成声音克隆和脚本口语标记
7. **剪辑模板搭建**:帮用户设计标准剪辑模板
8. **分发文案生成**:用第六步的模板生成全平台文案
**如果用户只需要某个环节的帮助,直接跳到对应步骤执行即可。**