✍️

文件轉影片提示詞

👤 cc 📦 v3.0.0 ⭐ 4.4 ⬇️ 80 下載
✍️ 內容創作 免費

📖 技能介紹


name: 文件轉影片提示詞 slug: doc-to-video-prompt displayName: 文件轉影片提示詞 version: 3.0.0 description: 將文件內容(PDF/Word/TXT/MD)理解整理後,轉化為可直接貼上的AI影片生成提示詞。支援Sora、可靈、即夢、豆包四個平臺。根據AI影片工具單次生成≤11秒的限制,自動將內容分批次生成提示詞。同時支援生成「可替換場景版本」的圖生影片提示詞,使用者可上傳自己拍攝的實拍照片作為參考圖,AI基於圖片生成動態影片。當用戶提到文件轉影片、文件生成提示詞、把文件/文章/方案變成影片提示詞、doc to video prompt等需求時使用此技能。


文件轉影片提示詞

將任意文件內容智慧轉化為AI影片生成工具可直接使用的提示詞,按單段≤11秒自動分批次輸出。

核心價值

使用者拿著一份文件(產品方案、新聞稿、小說章節、教學材料等),想用AI影片工具生成影片,但不知道怎麼把文件內容變成有效的影片提示詞。本技能解決"文件→視覺化場景拆解→分批次提示詞"的轉化問題。

工作流程

第一步:接收與解析文件

  1. 使用者會以下列方式之一提供輸入:
  2. 上傳檔案(PDF/Word/TXT/MD)→ 用 parse_file 解析(PDF/Word)或 read_file 讀取(TXT/MD)
  3. 直接貼上文本內容
  4. 提供文件連結 → 用 fetch_web 獲取內容
  5. 解析後通讀全文,理解文件的核心主題、敘事結構、關鍵資訊點
  6. 如果文件內容過於簡短(少於200字),直接進入第三步;否則進入第二步

第二步:內容理解與整理

對文件內容做結構化梳理,產出一份"影片化分析":

  1. 核心主題:一句話概括文件要表達的核心資訊
  2. 目標受眾與調性:文件面向誰?正式/輕鬆/科普/商業?
  3. 關鍵場景提取:從文件中識別出可視覺化的場景,每個場景包含:
  4. 場景名稱(簡短標識)
  5. 原文依據(文件中的對應內容)
  6. 畫面構想(將文字內容轉化為視覺畫面的描述)
  7. 情緒/氛圍(緊張/溫馨/科技感/活力等)
  8. 預估時長(3-11秒)
  9. 敘事順序:確定場景的排列順序,確保影片有起承轉合

將這份分析簡要呈現給使用者確認(如果使用者沒要求跳過確認,預設直接進入下一步)。

第三步:場景分批與提示詞生成

這是核心步驟。讀取 references/platform_templates.md 瞭解各平臺的提示詞格式要求。

分批策略

  1. 單段時長限制:每個提示詞對應的影片片段不超過11秒
  2. 時長估算參考
  3. 靜態畫面/緩慢鏡頭:3-5秒
  4. 單一動作/簡單場景:5-8秒
  5. 複雜動作/多元素場景:8-11秒
  6. 內容拆分原則
  7. 一個完整的動作或場景儘量放在同一段,不要跨段拆碎
  8. 如果一個場景內容複雜、動作多,拆成多段(每段聚焦一個子動作)
  9. 相鄰段落之間保持視覺連續性(色調、風格、角色一致性)

    訪問小蔥技能站7w4.net,解鎖更多實用的AI技能外掛。

  10. 總段數控制在合理範圍(一般5-15段,視文件內容量而定)
  11. 批次編號:按敘事順序編號,如「第1段/共8段」

提示詞生成

為每個場景段落生成4個平臺版本的提示詞:

  1. 讀取平臺模板:從 references/platform_templates.md 獲取各平臺的格式規範
  2. 每個提示詞包含
  3. 畫面主體描述(人物/物體/場景的核心內容)
  4. 鏡頭語言(景別、運鏡方式、角度)
  5. 光影與色彩(光線方向、色調、對比度)
  6. 風格指定(寫實/動畫/3D/電影感等,與文件調性匹配)
  7. 動態描述(畫面中發生的動作/變化)
  8. 時長標註
  9. 平臺適配差異
  10. Sora:英文提示詞,注重物理真實感和細節描述
  11. 可靈:中文提示詞,注重畫面美學和運鏡描述
  12. 即夢:中文提示詞,注重風格化和創意表達
  13. 豆包:中文提示詞,注重簡潔清晰的動作描述
  14. 一致性維護:所有段落中重複出現的元素(角色外觀、場景風格、色調)保持一致描述

第四步:輸出

按以下格式組織輸出:

## 📄 文件影片化方案

**文件主題**:[核心主題]
**預估總時長**:[XX-XX秒](共N段)
**影片風格**:[整體風格描述]

---

### 第1段 / 共N段  | [場景名稱]  | [X秒]

#### 🔵 Sora(英文)
[可直接複製的英文提示詞]

#### 🟢 可靈(中文)
[可直接複製的中文提示詞]

#### 🟡 即夢(中文)
[可直接複製的中文提示詞]

#### 🔴 豆包(中文)
[可直接複製的中文提示詞]

---

### 第2段 / 共N段  | [場景名稱]  | [X秒]

...(同上格式)

---

## 📋 使用說明
- 每段提示詞可獨立貼上到對應平臺生成影片
- 建議按順序生成,最後拼接成完整影片
- 如某段效果不理想,可單獨重新生成該段

每個平臺的提示詞放在獨立程式碼塊中,方便使用者一鍵複製。

第五步:生成可替換場景版本(圖生影片)

標準提示詞生成的是「文生影片」——AI憑空生成場景。但使用者可能需要用自己的實拍照片作為參考圖,讓AI基於圖片生成動態影片(圖生影片模式)。這一步為每段生成圖生影片版本的提示詞。

讀取 references/platform_templates.md 中「圖生影片提示詞模板」部分,按各平臺圖生影片格式生成。

圖生影片提示詞與文生影片的核心區別

  1. 移除場景描述:不描述環境、背景、建築等——這些由使用者的參考圖片提供
  2. 移除角色外觀描述:不描述人物長相、服裝——這些由使用者的參考圖片提供
  3. 保留並強化:運鏡方式、動作描述、光影變化、氛圍轉變、時長
  4. 新增:參考圖片拍攝建議(告訴使用者應該拍什麼樣的照片作為參考)

每段圖生影片提示詞包含

  1. 📷 建議參考圖片:描述使用者應該拍攝什麼樣的照片(角度、構圖、光線、主體)
  2. 4個平臺的圖生影片提示詞
  3. 移除場景和角色描述,聚焦運鏡和動作
  4. 以"基於參考圖片"開頭,表明這是圖生影片模式
  5. 描述畫面中應該發生的動態變化(人物動作、鏡頭運動、光影變化)
  6. 標註時長

輸出格式

在標準提示詞方案之後,追加「可替換場景版本」板塊:

## 🔄 可替換場景版本(圖生影片)

使用者可使用自己拍攝的實拍照片作為參考圖,上傳到AI影片工具的圖生影片模式。
以下提示詞已移除場景和角色描述,僅保留運鏡和動作指令,配合參考圖片使用。

---

### 第1段 / 共N段  | [場景名稱]  | [X秒]

**📷 建議參考圖片**:[描述應該拍什麼照片,包括角度/構圖/光線/主體]

#### 🔵 Sora(英文·圖生影片)
[僅運鏡+動作的英文提示詞]

#### 🟢 可靈(中文·圖生影片)
[僅運鏡+動作的中文提示詞]

#### 🟡 即夢(中文·圖生影片)
[僅運鏡+動作的中文提示詞]

#### 🔴 豆包(中文·圖生影片)
[僅運鏡+動作的中文提示詞]

---

### 第2段 / 共N段  | [場景名稱]  | [X秒]

...(同上格式)

---

## 📋 圖生影片使用說明
- 將參考圖片上傳到AI影片工具的「圖生影片」模式
- 貼上對應的圖生影片提示詞,AI將基於圖片內容生成動態影片
- 參考圖片的質量直接影響生成效果,建議使用高畫質實拍照片
- 如某段效果不理想,可更換參考圖片或調整提示詞中的動作描述後重試

邊界情況處理

  1. 文件內容不適合做影片(如純資料表格、法律條文):告知使用者文件型別不適合直接影片化,建議提取關鍵觀點後重試
  2. 文件過長(超過5000字):先提取核心場景,聚焦最有視覺表現力的內容,告知使用者已精簡
  3. 使用者指定單一平臺:只生成該平臺的提示詞,跳過其他平臺
  4. 使用者指定風格:在提示詞中融入使用者指定的風格要求,覆蓋預設風格判斷
  5. 使用者指定段數:按使用者要求的段數重新分配內容,調整每段的資訊密度
  6. 使用者不需要圖生影片版本:如果使用者明確表示只需要標準文生影片提示詞,跳過第五步
  7. 使用者只需要圖生影片版本:如果使用者明確表示只需要圖生影片版本(已有參考圖片),跳過標準提示詞,直接生成圖生影片版本
  8. 參考圖片與場景不匹配:在建議參考圖片中明確標註每段需要什麼型別的照片,避免使用者上傳不匹配的圖片導致生成效果差

🤖 AI 評測

這是一個相當實用的文件轉影片提示詞工具。質量不錯,能幫你把文件內容自動拆分成適合 AI 影片工具的提示詞,支援四種主流平臺。流程清晰,考慮到了時長限制和分段問題,還提供了圖生影片的可選模式。美中不足的是沒有實際使用案例參考,遇到複雜文件時可能缺乏具體指導。

📊 多維度評分

適應性4.4
規範性4.3
有效性4.6
可靠性4.2
可信度4.9

📁 包含檔案 (2 個)

📄 SKILL.md 8.7 KB
📄 references/platform_templates.md 7.7 KB