教育教程AI影片生成
核心能力
本Skill提供教育教程AI影片生成的全流程AI生成指導,覆蓋從創意構思、Prompt工程、工具鏈選擇、生成執行到後期最佳化的完整工作流。
方法論基礎
基於Code2Video框架的Tri-Agent架構:Planner(劇本架構)+ Coder(Manim動畫生成)+ Critic(視覺質量稽核)。3Blue1Brown風格的程式化影片合成保證數學精確性。認知負荷控制:每屏≤3個資訊點、動畫漸進式展開。白板/PPT/實景三模式自由切換。教學節奏:5-7分鐘黃金時長,每90秒設定互動錨點。
工作流
階段一:創意與指令碼規劃
- 明確影片目標(宣傳/教育/娛樂/轉化)
- 確定目標平臺與比例(橫屏16:9 / 豎屏9:16 / 方形1:1)
- 撰寫分鏡指令碼:每個鏡頭包含主體、場景、運動、時長
- 建立角色/產品視覺錨點檔案(如適用)
階段二:素材生成
- 靜態素材:使用Midjourney/Stable Diffusion/DALL·E生成關鍵幀
- 動態影片:使用Runway/Kling/Sora/Pika等AI影片工具生成鏡頭
- 角色一致性:Seed鎖定 + 參考圖注入 + Character Reference
- 場景一致性:統一色調 + 統一光照方向 + 統一風格標籤
階段三:後期合成
- 影片剪輯:CapCut/剪映進行鏡頭拼接與節奏控制
- 字幕與標題:AI自動字幕 + 風格化文字疊加
- 音訊處理:AI配音(TTS) + 背景音樂 + 音效
- 調色統一:LUT應用 + 顆粒匹配 + 風格化濾鏡
階段四:質量稽核
- 視覺連貫性檢查:角色/場景/色調一致性
- 時長與節奏檢查:是否符合平臺最佳實踐
- 品牌元素檢查:Logo/字型/色號是否正確
- 匯出設定:解析度/編碼/位元率最佳化
Prompt工程規範
基礎公式
主體 + 場景 + 運動
進階公式
主體(主體描述) + 場景(場景描述) + 運動(運動描述) + 美學控制 + 風格化
美學控制詞庫
- 景別:遠景/全景/中景/近景/特寫
- 視角:平視/俯視/仰視/第一人稱/第三人稱
- 運鏡:推/拉/搖/移/跟/固定鏡頭
- 光照:自然光/逆光/側光/柔光/霓虹燈/黃金時刻
- 鏡頭:35mm/50mm/85mm/廣角/魚眼
質量檢查清單
- [ ] 影片時長是否符合目標平臺要求
- [ ] 畫面比例是否正確(9:16/16:9/1:1)
- [ ] 角色/產品外觀在多鏡頭間保持一致
- [ ] 色調與光照在全部鏡頭間統一
- [ ] 字幕無錯別字且時間軸對齊
- [ ] 音訊與畫面同步(口型/動作/轉場)
- [ ] 品牌元素(Logo/字型/色號)準確
- [ ] 匯出解析度不低於1080P
- [ ] 前3秒有明確Hook/吸引點
- [ ] 結尾有清晰的CTA(如適用)
輸入規範
使用者需提供:
- 影片型別與目的
- 目標平臺(可選,預設社交媒體豎屏)
- 核心內容/產品描述
- 品牌元素(Logo、色號、字型偏好,可選)
- 時長要求(可選,預設15-60秒)
- 風格偏好(可選,預設寫實風格)
輸出規範
生成結果包含:
- 分鏡指令碼(鏡頭序號/時間戳/畫面描述/運鏡/時長)
小蔥技能7w4.net持續更新中。
- Prompt列表(每個鏡頭對應的AI影片生成Prompt)
- 工具鏈推薦(具體工具+引數設定)
- 後期合成指南(剪輯節奏/音訊/字幕)
工具推薦
| 階段 |
推薦工具 |
用途 |
| 影像生成 |
Midjourney / Stable Diffusion / DALL·E |
關鍵幀/參考圖生成 |
| 影片生成 |
Runway Gen3 / Kling AI / Sora / Pika |
動態影片生成 |
| 角色一致性 |
Leonardo.Ai / Higgsfield Soul |
角色鎖定與多鏡頭統一 |
| 語音合成 |
ElevenLabs / Descript |
TTS配音 |
| 音樂音效 |
Suno AI / Epidemic Sound |
背景音樂與音效 |
| 後期剪輯 |
CapCut / 剪映 / DaVinci Resolve |
合成與調色 |
| 字幕 |
剪映AI字幕 / Descript |
自動字幕生成 |
參考資源
詳細方法論、Prompt詞庫、工具引數指南請參閱 references/internal-manual.md。
完整輸出模板與規範請參閱 assets/specifications.json。