Pdf Vocab Audio

👤 effeceee 📦 v2.0.0 ⭐ 4.3 ⬇️ 584 下載
🎓 教育學習 免費

📖 技能介紹

PDF Vocabulary Audio Generator

從 PDF 詞彙表提取英文單詞,生成朗讀音訊。

作者

Maosi English Team

使用方法

# 指定PDF檔案
python3 pdf_vocab_audio.py /path/to/vocabulary.pdf

# 使用最新PDF(inbound目錄)
python3 pdf_vocab_audio.py

輸入格式

PDF 檔案中每行包含:

  • 英文單詞/片語 + 中文翻譯
  • 示例:tiger 老虎、computer game 電腦遊戲

    7w4.net小蔥技能。

處理規則

  1. 提取英文 - 每行只提取英文部分
  2. 保留片語 - 多個單詞的片語保持完整
  3. 每個讀兩遍 - 片語讀兩遍,中間停1秒
  4. 語速 - -20%,英式男聲 (en-GB-RyanNeural)

音訊格式

  • 語音:en-GB-RyanNeural
  • 語速:-20%
  • 停頓:1秒

輸出

  • 儲存到:/tmp/
  • 命名:{原檔名} 詞彙朗讀音訊.mp3

示例

輸入PDF內容:

tiger 老虎
message 訊息
computer game 電腦遊戲

輸出音訊:

  • tiger (第1遍) → 停1秒 → tiger (第2遍) → 停1秒
  • message (第1遍) → 停1秒 → message (第2遍) → 停1秒
  • computer game (第1遍) → 停1秒 → computer game (第2遍)

技術實現

  1. PDF解析:使用 PyMuPDF 提取文本
  2. 依賴檢查:使用 shutil.which() 驗證工具存在
  3. 英文過濾:正則匹配,只保留英文字母和空格
  4. 音訊生成:edge-tts 生成單詞/片語音訊
  5. 靜音生成:ffmpeg 生成1秒靜音片段
  6. 音訊合併:ffmpeg concat 合併所有片段

安全設計

  • ✅ 依賴驗證:啟動時檢查 edge-tts 和 ffmpeg 是否可用
  • ✅ 輸入驗證:PDF檔案存在性和格式檢查
  • ✅ 路徑隔離:所有操作在臨時目錄完成
  • ✅ 臨時目錄:使用系統臨時目錄,自動清理
  • ✅ subprocess安全:使用 shutil.which() 驗證工具路徑,引數列表傳遞
  • ✅ 超時保護:30秒超時防止程序掛起
  • ✅ 資源清理:臨時檔案自動清理

License

Apache License 2.0

🤖 AI 評測

這個 Skill 整體質量不錯,能從 PDF 生成詞彙朗讀音訊,發音清晰速度適中,適合背單詞時跟讀練習。安裝配置簡單,文件說明清楚。不足之處是音訊生成時間較長時沒有進度提示,而且只有英式發音可選,如果需要美式發音就無法滿足。總體適合對發音要求不高的學習場景使用。

📊 多維度評分

適應性4.4
規範性4
有效性4.3
可靠性4.3
可信度4.5

📁 包含檔案 (3 個)

📄 SKILL.md 2.8 KB
📄 _meta.json 134 B
📄 pdf_vocab_audio.py 5.8 KB