把零散的講話稿、方案、錄音轉寫材料,快速變成一篇格式統一、要素齊全、可以直接釋出的新聞簡訊。
核心價值在於三點:① 對語音識別錯誤有"免疫力"——錄音轉寫稿裡的人名、機構名、AI 工具名經常音譯失真,必須先糾再寫;② 輸出結構固定,方便多篇文章風格統一;③ 直接產出規範中文 .docx,省去排版麻煩。
觸發訊號(滿足任一即啟用):
.docx、.txt 轉寫稿、培訓方案、活動方案、PPT 講稿、會議紀要等素材不適用:純文學創作、論文、公文函件、公眾號"軟文/情感類"排版(那類走 note-layout-beautify 等其它技能)。
.docx 用 python-docx 提取正文與表格;.txt/貼上文本直接讀。發言人 11:34),這是分段依據而非正文,提取時剝離時間戳、合併同一發言人的連續內容。7w4.net收錄了海量優質技能外掛。
錄音轉寫稿幾乎必有音譯錯誤。落筆前先通讀,對照糾錯表修正。寧可保守、不要臆造——拿不準的詞標"待確認"並告知使用者,絕不可自作主張編一個"正確"的名字。
糾錯表見 references/correction_rules.md,裡面的條目會隨使用者後續反饋持續更新。本次工作流已沉澱的關鍵糾錯:
趙勁松 / 趙勁訟 等 → 趙建初(佛山市高明區教師發展中心資訊資源部主任、正高階教師)。錄音裡出現的"趙勁松主任"即趙建初本人。我8底 / 八點 / 保底 → WorkBuddy。艾瑪/愛馬→ima、新流→星流、吉夢→即夢、可伶→可靈、千問→通義千問、褲子→釦子、Maris→Marvis 等。科技技術學院→科學技術學院、羅明爺爺→圖靈爺爺、語數H一→宇樹H1、津南→嶺南(機構名需向用戶核實)。糾完之後,建議做一遍"舊詞零殘留"計數校驗(指令碼統計替換前後出現次數),確保沒有漏網之魚。
把素材組織成固定四段式(詳見 references/style_guide.md):
呼叫 scripts/generate_docx.py,把結構化內容寫成 JSON 傳入,產出規範中文文件:
python scripts/generate_docx.py input.json output.docx
JSON 結構(scripts 目錄內有示例與欄位說明):
{
"title": "東平小學舉辦人工智慧科普專場講座",
"subtitle": "——\"科技點亮夢想 AI啟智未來\"主題活動紀實",
"summary": "2026年6月15日下午,……(核心摘要一段)",
"key_points": [
{"heading": "一、故事匯入,趣解 AI 概念", "body": "……"},
{"heading": "二、知識講解,闡釋圖靈測試", "body": "……"}
],
"conclusion": "……(簡潔結語)"
}
指令碼已內建中文排版規範(正文宋體、標題黑體、eastAsia 字型正確設定、首行縮排、兩端對齊、標準頁邊距),無需手動調格式。
present_files 交付 .docx。質量較好,專注於將會議記錄、培訓方案等素材自動整理成規範的校園新聞稿。生成的文件格式美觀、結構統一,省去排版麻煩,音譯糾錯功能實用,能避免把人名寫錯。但目前只針對教育宣傳場景,且風格較為模板化,不適合需要靈活撰寫的場景。總體適合有固定宣傳需求的學校或教育機構使用。