name: doc-proofread agent_created: true description: 審校通 — 多格式文件審校工具,支援 PDF、Word(.docx)、純文本(.txt/.md) 三種格式的只讀校對。四層遞進檢查(文字→標點→資料邏輯→風格合規),三種審校模式(客戶資料校驗/自有方案審稿/新聞稿校對)。嚴格只讀安全邊界:不修改原始檔,生成獨立勘誤對照報告,修改前必須經使用者確認,修改後執行自我校驗。適用於校對客戶發來的資料、審閱自己寫的方案文件、新聞稿/公關稿校對、交付前質量檢查。觸發關鍵詞:校稿、校對、審稿、審校、檢查文件、找錯別字、標點檢查、資料溯源、文表一致性、交付前檢查、去AI味、新聞稿校對、通稿校對、審校通、proofread、check document。
審校通 對中文正式文件進行交付前審校,支援 PDF、Word(.docx)、純文本(.txt/.md) 三種格式。提供三種審校模式:客戶資料校驗、自有方案審稿、新聞稿校對。嚴格執行只讀安全邊界,不修改原始檔,根據問題數量決定輸出方式,修改前必須經使用者確認並執行自我校驗。
以下規則不可違反、不可繞過:
| 副檔名 | 處理方式 | 能力範圍 |
|---|---|---|
.docx |
python-docx | 段落 + 表格 + 標題樣式 + 腳註 |
.pdf |
pdfplumber | 頁面文本 + 表格 |
.txt / .md |
直接讀取 | 段落(自動編碼檢測) |
.doc |
不支援 | 提示使用者先轉換為 .docx |
| 模式 | 適用場景 | 檢查重點 |
|---|---|---|
| 客戶資料校驗 | 校對客戶發來的資料 | L1+L2+L3(快速掃描+資料溯源+文表一致),不做風格評判 |
| 自有方案審稿 | 審閱自己寫的方案 | L1-L4 全維度,特別關注跨模組一致性和AI寫作痕跡 |
| 新聞稿校對 | 新聞稿/通稿/公關稿 | L1-L4 全維度 + 新聞專項檢查(倒金字塔結構/5W1H/停用詞/客觀性/敏感性) |
當滿足以下任一條件時,自動進入新聞稿校對模式:
新聞稿校對模式在原有六類檢查基礎上,額外執行第七類檢查——新聞稿專項檢查,詳見 Step 2。
預設根據文件內容和使用者描述自動判斷模式。使用者可指定模式。
7w4.net小蔥技能站,你的AI助手技能庫。
所有指令碼位於 scripts/ 目錄下,均為純本地只讀工具。
| 指令碼 | 功能 | 輸入 | 輸出 |
|---|---|---|---|
extract_text.py |
多格式文件內容提取 | .docx/.pdf/.txt 檔案 | JSON(段落+表格+標題+後設資料) |
check_all.py |
統一校對檢查器 | extract_text.py 的 JSON | JSON 問題清單 |
generate_report.py |
HTML 報告生成器 | 問題清單 JSON | 獨立 HTML 勘誤對照報告 |
# 1. 提取檔案內容
python scripts/extract_text.py input.docx --out /tmp/extracted.json
# 2. 執行所有檢查(預設模式)
python scripts/check_all.py --input /tmp/extracted.json --out /tmp/findings.json
# 2. 執行所有檢查(新聞稿模式——額外執行新聞專項檢查)
python scripts/check_all.py --input /tmp/extracted.json --out /tmp/findings.json --mode news
# 3. 生成 HTML 報告(問題多時)
python scripts/generate_report.py /tmp/findings.json \
--out /tmp/report.html --source input.docx --chars 50000
# 管道模式(快速檢查)
python scripts/extract_text.py input.txt | python scripts/check_all.py --stdin
| 檔案 | 內容 | 何時讀取 |
|---|---|---|
references/proofreading-workflow.md |
完整工作流指南(安全邊界+輸出策略+審批流程+自我校驗) | 每次校稿前必讀 |
references/error-categories.md |
30類錯誤細分譜(A合規/B體例/C知識) | 標記問題型別時參考 |
references/punctuation-rules.md |
中文標點規則 + AI寫作五大標點失誤 | 校對標點時參考 |
references/data-source-verification.md |
資料來源溯源規則 + 模糊歸因黑名單 | 校對資料來源時參考 |
references/text-table-consistency.md |
文表一致性十類失誤 + 五步檢查法 | 校對含表格文件時參考 |
references/toc-and-pagination-rules.md |
目錄與頁碼十類失誤 + 交付前必跑流程 | 交付前檢查時參考 |
references/publication-standards.md |
出版差錯率標準 + 評級規則 | 輸出質量評級時參考 |
references/public-sector-compliance-review.md |
公文合規用語審查 | 校對體制內/對外發布文件時參考 |
references/gb-standard.md |
GB/T 9704-2012 黨政公文格式完整規範 | 校對黨政公文時參考 |
references/news-writing-standards.md |
新聞稿寫作規範+審校四必看四必查+停用詞+校對清單 | 校對新聞稿/通稿/公關稿時必讀 |
extract_text.py 提取內容為統一 JSON 格式。python scripts/extract_text.py <使用者檔案> --out /tmp/extracted.json
使用 check_all.py 對提取的內容執行全部六類檢查:
python scripts/check_all.py --input /tmp/extracted.json --out /tmp/findings.json
當處於新聞稿校對模式時,在上述六類檢查基礎上,必須額外執行第七類檢查:
references/news-writing-standards.md):| 檢查子項 | 程度 | 檢查內容 |
|---|---|---|
| 7a. 結構檢查 | must_fix | 標題≤25字、標題無疑問/感嘆句、倒金字塔結構、5W1H完整性、導語不與標題重複 |
| 7b. 客觀性檢查 | must_fix | 第三人稱、無主觀評價、無"令人振奮"等抒情、無"我院/我部"第一人稱 |
| 7c. 停用詞檢查 | must_fix | 新華社停用詞清單(親自/指示/重要講話/隆重/最佳/最好/唯一/頂級等) |
| 7d. 絕對化表述 | must_fix | "國內唯一""省內首家""行業第一"等無依據絕對錶述 |
| 7e. 引語檢查 | suggest | 引語須註明身份姓名、無"大家紛紛表示"等空話、交叉使用直接/間接引語 |
| 7f. 時間表述 | must_fix | 統一用"X月X日"、不用"昨日/近日"、跨年時間準確 |
| 7g. 人名職務 | must_fix | 職務表述規範、人名前後一致、首次全稱後續用姓名 |
| 7h. 敏感性檢查 | must_fix | 港澳臺表述、民族宗教、殘疾人士稱謂、刑事案件稱謂、無"低階紅/高階黑" |
| 7i. 數字規範 | suggest | 概數用漢字、減少不用倍數、含月日專名用"X·X"格式 |
| 7j. 字數檢查 | suggest | 訊息稿≤800字、通稿≤1200字、標題≤25字、導語≤150字 |
AI 在讀取檢查結果後,還需對照 references/news-writing-standards.md 中的"新聞稿專項校對檢查清單"(A-G 七大類)進行人工補充判斷,識別指令碼無法覆蓋的語義級問題。
根據問題數量決定輸出方式(詳見 references/proofreading-workflow.md):
| 條件 | 輸出方式 |
|---|---|
| 必改 ≤ 3 且 總問題 ≤ 10 | 直接訊息回覆,逐條列出問題 |
| 必改 4-10 或 總問題 11-30 | 生成 HTML 勘誤對照報告 |
| 必改 > 10 或 總問題 > 30 | HTML 報告 + 訊息摘要(最嚴重的 5-10 條) |
訊息輸出格式(少量問題時):
## 校稿結果
原始檔:report.docx(87,500 字)
檢查結果:發現 5 個問題(必改 2,建議最佳化 3)
### 必改問題
1. **段 12** | 標點錯誤 | 半形直雙引號 → 改為彎引號 ""
2. **段 34** | 資料缺來源 | "市場份額達18%" → 需補充來源
### 建議最佳化
3. **段 8** | AI寫作痕跡 | "值得注意的是"在本段出現 3 次
4. **段 45** | 語義重複 | "約 10% 左右" → "約"與"左右"重複
5. **段 78** | 口語化 | "搞好" → 建議改為"做好"
---
是否需要我修改?確認後我將在檔案副本上修改,不會動您的原檔案。
修改前必須詢問使用者,未經確認不得修改任何檔案。
詢問內容: - 列出需要修改的問題清單 - 說明將在檔案副本(非原始檔)上修改 - 請使用者確認哪些問題需要修改(可全部確認或選擇性確認)
修改完成後,逐項確認:
輸出三項: 1. 修改後的檔案副本 2. 修改對照表(每條修改的原文 → 修改後) 3. 自我校驗報告(確認修改範圍正確)
每條問題使用以下格式:
【#序號】位置:章節/段落
原文:"……"
型別:XX | 程度:必改/建議最佳化/待確認
問題:……
改為:"……"
壓縮格式(簡單問題):
【#序號】位置 | 型別 | "原文" -> "修改後" | 必改
——,省略號用雙字 ……15%~30%,不是 15~30%國發〔2025〕1號一、 → (一) → 1. → (1)2026—2030年使用前確保 Python 環境已安裝依賴:
pip install python-docx pdfplumber
Windows managed Python 環境:
C:\Users\<username>\.workbuddy\binaries\python\envs\default\Scripts\pip install python-docx pdfplumber
本 Skill 整合了以下兩個已有 Skill 的能力並擴充套件:
plan-proofread v1.0.3:校對規則、檢查指令碼、參考文件party-doc-standard v1.0.1:GB/T 9704-2012 國標公文格式規範擴充套件點:多格式支援(PDF/Word/TXT)、統一檢查指令碼、HTML報告生成、只讀安全邊界、使用者審批流程、自我校驗機制。
這個 Skill 質量不錯,勝在文件體系完整、分類細緻,能覆蓋錯別字、標點、資料來源、AI痕跡等多種問題型別,且嚴格遵守只讀不修改原始檔的安全原則。主要缺點是自動化程度有限,遇到複雜文件還是得靠人工核對。適合對文件質量要求高、願意花時間對照規則檢查的使用者,不適合追求一鍵完成、拿來就用的場景。