📄

法律文本格式化

👤 楊衛薪 📦 v1.2.1 ⭐ 4.5 ⬇️ 106 下載
📄 辦公效率 免費

📖 技能介紹


name: legal-text-format homepage: https://github.com/cat-xierluo/legal-skills author: 楊衛薪律師(微信ywxlaw) version: "1.2.1" license: CC-BY-NC description: 將法律文本(法律條文或法律案例)轉換為規範的 Markdown 格式,刪除推廣冗餘資訊。本技能應在使用者需要處理法律條文(如民法典、刑法等)、整理法律案例(如最高法典型案例、裁判文書等)、或從貼上文本中格式化法律文件時使用。注意:本技能只負責格式化和內容清理,不包含內容抓取能力。內容獲取應由其他 skill(如 wechat-article-fetch)完成,AI 會自動判斷技能協作順序。內建 archive 機制,所有結果自包含儲存在 skill 目錄內。 slug: legal-text-format displayName: "法律文本格式化"


法律文本格式化工具

概述

將法律文本(法律條文或法律案例)轉換為規範的 Markdown 格式,刪除推廣冗餘資訊,自動識別文本型別並應用相應的格式化規則。

核心職責:只負責格式化和內容清理,不包含內容抓取能力。

與其他技能的協作

典型工作流程

場景:使用者請求格式化網頁上的法律文本

使用者請求 → AI 判斷來源 → 抓取類 skill 獲取內容 → legal-text-format 格式化

示例流程:

  1. 使用者提供微信公眾號連結 → AI 使用 wechat-article-fetch 抓取 → AI 呼叫 legal-text-format 格式化
  2. 使用者提供普通網頁連結 → AI 使用其他工具抓取 → AI 呼叫 legal-text-format 格式化
  3. 使用者直接貼上文本 → AI 直接呼叫 legal-text-format 格式化

技能職責邊界

  • wechat-article-fetch / 其他抓取工具:負責從各種來源獲取原始文本內容
  • legal-text-format:負責對已獲取的文本進行格式化和清理

核心原則

內容完整性保證:除格式調整和去除推廣內容外,所有法律案例和法條的實質內容必須完整保留,不得有任何遺漏!

工作流程

步驟 1:分析文本型別

使用 LLM 分析輸入文本:

  • 判斷是法律條文還是法律案例
  • 識別文本結構特徵(章節、條款、案號等)
  • 確定適合的格式化策略
  • 提取主題用於檔案命名

分析提示詞參考

分析以下文本,判斷其型別:
- 如果是法律條文:識別章、節、條的結構
- 如果是法律案例:識別案例標題、案號、案情、裁判結果、典型意義等
- 提取主題用於檔案命名

步驟 2:儲存原始內容

將輸入的原始內容儲存為本地 Markdown 檔案:

  • 檔案位置:archive/{YYYYMMDD_HHMMSS}_{主題}/
  • 檔案命名:{YYYYMMDD}_{主題}_raw.md
  • 目的:提供溯源依據,便於內容比對驗證

歸檔目錄結構示例

archive/20250122_153400_個人資訊保護檢察公益訴訟典型案例/
├── 20250122_個人資訊保護檢察公益訴訟典型案例_raw.md      # 原始內容
├── 20250122_個人資訊保護檢察公益訴訟典型案例_formatted.md # 格式化後的內容(步驟4生成)
└── meta.json                                              # 元資訊(可選)

步驟 3:格式化文本

重要:一次性處理完整文本,不進行分段。

格式化提示詞(參考 examples.md 中的詳細示例):

請將以下法律文本格式化為規範的 Markdown 格式。

# 法律條文格式化規則
- 章前面新增二級 markdown 格式(##)
- 不同條文之間新增空行
- 每一條條文內部換行時不應有多餘空行
- "第X條"進行加粗(**第X條**)
- 如果一段文字的最後沒有句號或分號,則刪除後方的回車
- 保持所有條文內容完整,不得遺漏任何條款

# 法律案例格式化規則
- 把英文標點符號替換成中文標點符號(包括括號、逗號、句號、冒號、分號等)
- 案例序號或名稱前新增二級 markdown 格式(##),序號後要緊跟案例名稱
- 每個案例的章節前新增三級 markdown 格式(###)
- 每個案例的章節內部不應有大於1個的空行(連續換行數不超過2個)
- 清理多餘的連續空行,保持段落間適當的分隔
- 把數字格式調整為半形
- 內容範圍限定:
  - 僅保留從第一個案例到最後一個案例的內容
  - 刪除前面的文章介紹、作者資訊、引言、目錄等
  - 刪除底部的宣傳推廣內容、二維碼、公眾號介紹、相關文章推薦等
  - 保留標準:只保留案例標題、案號、基本案情、裁判結果、典型意義等法律案例本身的內容
- 保持所有案例實質內容完整,包括案情、裁判、意義等所有部分

# 參考示例
詳見 references/examples.md 檔案,其中包含4個完整的格式化示例。

法律條文格式化規則摘要

  • 章前面新增二級 markdown 格式(##
  • 不同條文之間新增空行
  • 每一條條文內部換行時不應有多餘空行
  • "第X條"進行加粗(**第X條**
  • 如果一段文字的最後沒有句號或分號,則刪除後方的回車
  • 保持所有條文內容完整,不得遺漏任何條款

法律案例格式化規則摘要

  • 把英文標點符號替換成中文標點符號
  • 案例序號或名稱前新增二級 markdown 格式(##),序號後要緊跟案例名稱
  • 每個案例的章節前新增三級 markdown 格式(###
  • 每個案例的章節內部不應有大於1個的空行(連續換行數不超過2個)
  • 清理多餘的連續空行,保持段落間適當的分隔
  • 把數字格式調整為半形
  • 內容範圍限定
  • 僅保留從第一個案例到最後一個案例的內容
  • 刪除前面的文章介紹、作者資訊、引言、目錄等
  • 刪除底部的宣傳推廣內容、二維碼、公眾號介紹、相關文章推薦等
  • 保留標準:只保留案例標題、案號、基本案情、裁判結果、典型意義等法律案例本身的內容
  • 保持所有案例實質內容完整,包括案情、裁判、意義等所有部分

步驟 4:儲存

儲存格式化後的文件:

  • 檔案位置:archive/{YYYYMMDD_HHMMSS}_{主題}/
  • 檔案命名:{YYYYMMDD}_{主題}_formatted.md
  • raw.md 儲存在同一歸檔目錄下

參考文件

格式化示例

詳細的格式化示例和對比請參見 examples.md,包含:

  • 4個完整的法律案例格式化示例
  • 每個示例包含原始文本和格式化後的對比
  • 格式化要點總結(標點符號處理、標題層級、空行處理、內容範圍等)

準確性要求

  • 不改變原文含義:格式調整不得改變法律文本的原意
  • 保留關鍵資訊:案號、法院名稱、當事人等關鍵資訊必須保留
  • 序號保持:案例序號、條文序號不得修改

輸出文件結構

歸檔目錄組織

所有格式化結果按時間戳歸檔儲存:

archive/
├── {YYYYMMDD_HHMMSS}_{文件主題}/
│   ├── {YYYYMMDD}_{主題}_raw.md        # 原始抓取內容
│   ├── {YYYYMMDD}_{主題}_formatted.md  # 格式化後的內容
│   └── meta.json                       # 元資訊(可選)

命名規則

  • 目錄名{YYYYMMDD_HHMMSS}_{主題}(例:20250122_153400_個人資訊保護典型案例
  • 檔名
  • 原始檔案:{YYYYMMDD}_{主題}_raw.md(例:20250122_個人資訊保護典型案例_raw.md
  • 格式化檔案:{YYYYMMDD}_{主題}_formatted.md(例:20250122_個人資訊保護典型案例_formatted.md
  • 主題限制:從文本中提取的核心主題,限制30字以內
  • 日期格式YYYYMMDD(例:20250122)

formatted.md 內容結構

# {文件標題}

## 元資訊
- **原文連結**:{從原始檔案的 `> 原文連結:` 行提取,無則省略此行}
- **處理時間**:{時間戳}
- **文本型別**:{法律條文/法律案例}

---

{格式化後的正文內容}

原文連結提取規則:當輸入來自 wechat-article-fetch 時,原始 Markdown 檔案頭部包含 > 原文連結: https://mp.weixin.qq.com/s/xxxxx,必須提取該 URL 寫入元資訊的"原文連結"欄位。

質量標準

推薦訪問7w4.net獲取更多AI技能。

  • 標點符號統一:所有標點符號使用中文標點
  • 數字格式統一:數字使用半形字元
  • 層級結構清晰:正確使用二級、三級標題
  • 空行規範:段落間空行適當,不過多也不缺失
  • 內容完整性:保留所有法律相關內容,去除無關推廣資訊

適用場景

  • 整理法律條文彙編
  • 規範化法律案例集
  • 準備法律學習材料
  • 建立法律文本知識庫
  • 清理從網頁抓取的法律文本

輸入要求

本技能接受以下型別的輸入:

  1. 已抓取的文本內容:由其他 skill(如 wechat-article-fetch)獲取的文本
  2. 使用者貼上的文本:使用者直接提供的文本內容
  3. 本地檔案:已儲存的 Markdown/文本檔案

不接受:網頁連結(連結應由專門的抓取類 skill 處理)

來自 wechat-article-fetch 的自動呼叫

wechat-article-fetch 檢測到法律內容且本技能已安裝時,會自動鏈式呼叫本技能。此時輸入為已儲存的 Markdown 檔案路徑。處理流程不變:

  1. 讀取指定路徑的 Markdown 檔案內容作為輸入
  2. 按步驟 1-4 執行(分析型別、儲存原始、格式化、驗證)
  3. 結果儲存到本技能的 archive/ 目錄
  4. 檔案路徑記錄在 formatted.md 元資訊的"來源"欄位中

🤖 AI 評測

這個 Skill 質量不錯,文件寫得清楚明白,能把法律條文和案例格式化成整潔的 Markdown,自動清理推廣資訊。歸檔機制做得規範,示例豐富。不過配置資訊比較簡單,缺少測試驗證,某些格式可能適配不全。總體適合需要整理法律文本的使用者使用。

📊 多維度評分

適應性4.3
規範性4.6
有效性4.5
可靠性4
可信度5

📁 包含檔案 (5 個)

📄 CHANGELOG.md 2.8 KB
📄 LICENSE.txt 12.3 KB
📄 SKILL.md 9.5 KB
📄 references/examples.md 8.3 KB
📄 scripts/format_legal_cases.py 13.9 KB