教育教程AI视频生成
核心能力
本Skill提供教育教程AI视频生成的全流程AI生成指导,覆盖从创意构思、Prompt工程、工具链选择、生成执行到后期优化的完整工作流。
方法论基础
基于Code2Video框架的Tri-Agent架构:Planner(剧本架构)+ Coder(Manim动画生成)+ Critic(视觉质量审核)。3Blue1Brown风格的程序化视频合成保证数学精确性。认知负荷控制:每屏≤3个信息点、动画渐进式展开。白板/PPT/实景三模式自由切换。教学节奏:5-7分钟黄金时长,每90秒设置互动锚点。
工作流
阶段一:创意与脚本规划
- 明确视频目标(宣传/教育/娱乐/转化)
- 确定目标平台与比例(横屏16:9 / 竖屏9:16 / 方形1:1)
- 撰写分镜脚本:每个镜头包含主体、场景、运动、时长
- 建立角色/产品视觉锚点档案(如适用)
阶段二:素材生成
- 静态素材:使用Midjourney/Stable Diffusion/DALL·E生成关键帧
- 动态视频:使用Runway/Kling/Sora/Pika等AI视频工具生成镜头
- 角色一致性:Seed锁定 + 参考图注入 + Character Reference
- 场景一致性:统一色调 + 统一光照方向 + 统一风格标签
阶段三:后期合成
- 视频剪辑:CapCut/剪映进行镜头拼接与节奏控制
- 字幕与标题:AI自动字幕 + 风格化文字叠加
- 音频处理:AI配音(TTS) + 背景音乐 + 音效
- 调色统一:LUT应用 + 颗粒匹配 + 风格化滤镜
阶段四:质量审核
- 视觉连贯性检查:角色/场景/色调一致性
- 时长与节奏检查:是否符合平台最佳实践
- 品牌元素检查:Logo/字体/色号是否正确
- 导出设置:分辨率/编码/比特率优化
Prompt工程规范
基础公式
主体 + 场景 + 运动
进阶公式
主体(主体描述) + 场景(场景描述) + 运动(运动描述) + 美学控制 + 风格化
美学控制词库
- 景别:远景/全景/中景/近景/特写
- 视角:平视/俯视/仰视/第一人称/第三人称
- 运镜:推/拉/摇/移/跟/固定镜头
- 光照:自然光/逆光/侧光/柔光/霓虹灯/黄金时刻
- 镜头:35mm/50mm/85mm/广角/鱼眼
质量检查清单
- [ ] 视频时长是否符合目标平台要求
- [ ] 画面比例是否正确(9:16/16:9/1:1)
- [ ] 角色/产品外观在多镜头间保持一致
- [ ] 色调与光照在全部镜头间统一
- [ ] 字幕无错别字且时间轴对齐
- [ ] 音频与画面同步(口型/动作/转场)
- [ ] 品牌元素(Logo/字体/色号)准确
- [ ] 导出分辨率不低于1080P
本技能来自小葱技能站7w4.net。
- [ ] 前3秒有明确Hook/吸引点
- [ ] 结尾有清晰的CTA(如适用)
输入规范
用户需提供:
- 视频类型与目的
- 目标平台(可选,默认社交媒体竖屏)
- 核心内容/产品描述
- 品牌元素(Logo、色号、字体偏好,可选)
- 时长要求(可选,默认15-60秒)
- 风格偏好(可选,默认写实风格)
输出规范
生成结果包含:
- 分镜脚本(镜头序号/时间戳/画面描述/运镜/时长)
- Prompt列表(每个镜头对应的AI视频生成Prompt)
- 工具链推荐(具体工具+参数设置)
- 后期合成指南(剪辑节奏/音频/字幕)
工具推荐
| 阶段 |
推荐工具 |
用途 |
| 图像生成 |
Midjourney / Stable Diffusion / DALL·E |
关键帧/参考图生成 |
| 视频生成 |
Runway Gen3 / Kling AI / Sora / Pika |
动态视频生成 |
| 角色一致性 |
Leonardo.Ai / Higgsfield Soul |
角色锁定与多镜头统一 |
| 语音合成 |
ElevenLabs / Descript |
TTS配音 |
| 音乐音效 |
Suno AI / Epidemic Sound |
背景音乐与音效 |
| 后期剪辑 |
CapCut / 剪映 / DaVinci Resolve |
合成与调色 |
| 字幕 |
剪映AI字幕 / Descript |
自动字幕生成 |
参考资源
详细方法论、Prompt词库、工具参数指南请参阅 references/internal-manual.md。
完整输出模板与规范请参阅 assets/specifications.json。