文件能聽

👤 天線同學 📦 v1.0.0 ⭐ 4.4 ⬇️ 393 下載
📄 辦公效率 免費

📖 技能介紹


name: doc-to-speech description: 將電腦裡的Word、PDF、TXT等文件轉換為MP3語音檔案,讓使用者可以聽文件內容,緩解視覺疲勞。支援批次轉換、語音選擇、語速調節。當用戶需要聽文件、將文章轉為音訊、批次轉換文件為聲音檔案時啟用。


文件轉語音 (Doc to Speech)

將Word、PDF、TXT等文件轉換為MP3音訊檔案,讓使用者可以"聽"文件內容,緩解視覺疲勞。

功能特性

  • 多格式支援: Word (.docx)、PDF (.pdf)、TXT (.txt)、Markdown (.md) 等
  • 批次轉換: 支援同時轉換多個檔案或整個資料夾
  • 語音選擇: 可選擇不同的語音和語速
  • 離線/線上: 支援離線TTS (pyttsx3) 和線上TTS (Google TTS)
  • 中文支援: 完整支援中文文件朗讀

使用場景

  • 長時間閱讀導致眼睛疲勞,想聽文件內容
  • 通勤路上想"聽"文章或報告
  • 需要批次將文件轉為有聲書
  • 視力不便的使用者需要語音輔助閱讀

快速開始

1. 安裝依賴

首次使用前,安裝必要的依賴庫:

python scripts/install_dependencies.py

或手動安裝:

pip install docx2txt pdfplumber PyPDF2 pyttsx3 gtts

2. 轉換單個檔案

# 基本用法
python scripts/doc_to_speech.py 文件.docx

# 指定輸出路徑
python scripts/doc_to_speech.py 文件.docx -o 輸出.mp3

# 調整語速
python scripts/doc_to_speech.py 文件.pdf -r 120

# 使用Google TTS(線上,質量更好)
python scripts/doc_to_speech.py 文件.txt -e gtts

3. 批次轉換

# 轉換多個檔案
python scripts/doc_to_speech.py 檔案1.docx 檔案2.pdf 檔案3.txt

# 轉換整個資料夾
python scripts/doc_to_speech.py ./文件資料夾/ -o ./輸出音訊/

4. 檢視可用語音

python scripts/doc_to_speech.py --list-voices

引數說明

引數 說明 示例
input 輸入檔案或資料夾路徑 文件.docx
-o, --output 輸出路徑 -o 音訊.mp3
-e, --engine TTS引擎 (pyttsx3gtts) -e pyttsx3
-v, --voice 語音ID -v 0
-r, --rate 語速 (預設150) -r 120
-l, --lang 語言程式碼 (gtts用) -l zh-cn
--list-voices 列出可用語音 --list-voices

工作流程

當用戶需要將文件轉為語音時:

  1. 確認需求: 瞭解使用者要轉換的檔案、輸出要求
  2. 檢查依賴: 確保必要庫已安裝
  3. 執行轉換: 執行轉換指令碼
  4. 驗證結果: 確認MP3檔案生成成功

技術說明

支援的文件格式

  • Word (.docx): 使用 docx2txt 提取文本
  • PDF (.pdf): 使用 pdfplumberPyPDF2 提取文本
  • 文本 (.txt, .md): 直接讀取,自動檢測編碼

TTS引擎對比

引擎 型別 優點 缺點
pyttsx3 離線 無需網路,響應快,免費 語音質量一般
gTTS 線上 語音質量高,自然流暢 需要網路,有請求限制

注意事項

  • 長文件會自動分段處理
  • PDF掃描件(圖片)無法直接轉換,需要先OCR
  • 部分PDF格式複雜可能提取文本不完整
  • Windows系統建議安裝中文語音包以獲得更好效果

示例

示例1:轉換Word文件

python scripts/doc_to_speech.py 報告.docx -o 報告音訊.mp3 -r 130

示例2:批次轉換資料夾

python scripts/doc_to_speech.py ./我的文件/ -o ./有聲書/ -e gtts

示例3:Python程式碼呼叫

from scripts.doc_to_speech import convert_file

# 轉換單個檔案
convert_file(
    input_path="文章.pdf",
    output_path="文章.mp3",
    engine="pyttsx3",
    rate=140
)

故障排除

問題:無法提取PDF文本

解決: 安裝pdfplumber

7w4.net小蔥技能。

pip install pdfplumber

問題:中文朗讀效果差

解決: 1. Windows使用者安裝Microsoft Speech Platform 2. 或使用線上引擎: -e gtts

問題:轉換速度慢

解決: - 使用離線引擎 pyttsx3 代替 gtts - 減少單次轉換的文本量

問題:語音斷斷續續

解決: 調整語速引數 -r,建議範圍 120-180

🤖 AI 評測

這是一個實用的文件轉語音工具,能將 Word、PDF 等文件轉為 MP3 播放。優點是功能齊全、文件清晰、使用簡單,支援離線使用。不足之處是批次轉換時沒有進度提示,長文件可能受限,中文語音質量依賴系統配置。整體質量良好,能滿足日常文件轉語音的需求。

📊 多維度評分

適應性4.2
規範性4.3
有效性4.5
可靠性4.2
可信度4.8

📁 包含檔案 (3 個)

📄 SKILL.md 4.1 KB
📄 scripts/doc_to_speech.py 8.9 KB
📄 scripts/install_dependencies.py 1.9 KB