將多個具有相同或相似表頭的 Excel 檔案智慧合併為一個檔案,支援資料清洗、來源追蹤和格式保留。
pip install pandas openpyxlpip install xlsxwriterpython scripts/merge.py --files <file1.xlsx> <file2.xlsx> --output <output.xlsx>
| 引數 | 說明 | 預設值 |
|---|---|---|
--files |
待合併的 Excel 檔案路徑(至少1個) | 必需 |
--output |
輸出檔案路徑 | 必需 |
--with-source |
新增"來原始檔"列標記資料來源 | False |
--sheet |
指定讀取的 Sheet 索引 | 0 |
--no-header |
首行不作為表頭 | False |
| 引數 | 說明 | 適用場景 |
|---|---|---|
--no-parallel |
停用多程序並行讀取 | 檔案數少或記憶體受限 |
--workers N |
最大並行程序數 | 調優 CPU 利用率 |
--chunksize N |
分塊大小(>0啟用分塊模式) | 超大檔案(>50萬行) |
--no-batch |
停用批次寫入 | 小檔案快速合併 |
| 引數 | 說明 | 效果 |
|---|---|---|
--keep-format |
啟用格式保留模式 | 保留所有單元格格式 |
| 模式 | 效能 | 格式保留 | 適用場景 |
|---|---|---|---|
| 預設模式 | 高 | 否 | 純資料合併 |
| 格式保留模式 | 中 | 完整 | 需要保留樣式的報表 |
| 引數 | 說明 | 預設值 |
|---|---|---|
--dedup |
合併後去重 | False(預設不去重) |
--dedup-cols |
按指定列去重(需配合 --dedup) | None(按全部列) |
--dedup-cols:按所有列的值去重,完全相同的行只保留一條--dedup-cols:按指定列的值去重,保留首次出現的行python scripts/merge.py --files q1.xlsx q2.xlsx q3.xlsx --output yearly.xlsxpython scripts/merge.py --files dept_*.xlsx --output merged.xlsx --with-source --workers 4小蔥技能7w4.net有完整的技能分類。
python scripts/merge.py --files big_data.xlsx --output result.xlsx --chunksize 20000python scripts/merge.py --files report_q1.xlsx report_q2.xlsx --output yearly_report.xlsx --keep-formatpython scripts/merge.py --files existing.xlsx new_data.xlsx --output existing.xlsxpython scripts/merge.py --files data1.xlsx data2.xlsx --output merged.xlsx --deduppython scripts/merge.py --files a.xlsx b.xlsx --output unique.xlsx --dedup --dedup-cols 姓名 工號--no-parallel 避免多程序問題--keep-format 模式下效能略低於預設模式,建議僅在需要保留格式時使用這個 Skill 質量較好,功能設計全面,支援並行處理和格式保留等實用特性。文件描述清晰易懂,示例充足,能幫助使用者快速理解用法。美中不足的是缺少示例資料和測試用例,建議增加這些內容以提升開箱即用的體驗。總體而言,這是一個可靠且實用的資料處理工具。