網頁圖片批次下載

👤 qiuqiu 📦 v1.0.1 ⭐ 4.4 ⬇️ 834 下載
📊 資料分析 免費

📖 技能介紹


name: web-image-downloader description: | 網頁圖片下載器。輸入任意網站地址,自動提取並下載該網頁上所有的圖片。 當用戶說"下載網頁圖片"、"下載這個網站的所有圖片"、"批次下載圖片"、 "下載網頁上的圖片"、"幫我把這個頁面的圖片都下下來"時觸發。 支援 JPG、PNG、GIF、WebP、SVG、AVIF、HEIC 等常見圖片格式。 特性:去重檢測(MD5 + 感知雜湊)、圖集識別、進度顯示、尺寸過濾、廣告過濾、 增量更新、Cookie 登入態支援、斷點續傳、語義化命名、併發下載、質量過濾、AI 智慧分類。 version: 1.4.0


[Image] 網頁圖片下載器

輸入任意網站地址,自動下載該網頁上所有的圖片,按型別/AI 智慧分類並打包為 ZIP。

何時使用

  • 批次獲取某個網頁上的所有圖片
  • 收集圖片素材、桌布、參考圖
  • 備份網站圖片資源
  • 下載整套相簿或圖片集
  • 下載需要登入才能訪問的圖片
  • 批次下載多個網站圖片(逗號分隔 / URL 檔案)
  • 自動按內容分類整理(人物、風景、產品、截圖等)

目錄結構

web-image-downloader/
├── SKILL.md              <- 主入口(本檔案)
├── references/           <- 詳細參考文件
│   ├── filter-rules.md   <- 過濾規則詳解
│   ├── api-reference.md  <- 技術介面文件
│   └── output-format.md  <- 輸出格式說明
├── scripts/              <- 可執行指令碼
│   ├── main.py           <- 主下載指令碼
│   ├── dedupe.py         <- 去重指令碼 (MD5 + pHash)
│   ├── quality.py        <- 質量過濾指令碼 (v1.4.0)
│   ├── classify.py       <- AI 智慧分類指令碼 (v1.4.0)
│   ├── progress.py       <- 進度條指令碼
│   └── zipper.py         <- ZIP 打包指令碼
├── assets/               <- 靜態資源
│   └── download-form.html
└── evals/
    └── evals.json

使用方法

步驟 1:提供網址

輸入目標網頁的完整 URL,或多個 URL(逗號分隔 / URL 檔案)。

步驟 2:指定引數(可選)

引數 說明 預設值
儲存路徑 圖片儲存位置 Downloads/web-images/[域名]/
最小尺寸 寬度或高度 >= 此值(px) 100
最大尺寸 寬度或高度 <= 此值(px) 不限制
圖集識別 識別並下載圖片集 true
增量更新 對比已有檔案,只下載新增 false
併發數 同時下載的執行緒數 3
Cookie 登入態 Cookie 字串
Cookie 檔案 Netscape 格式 Cookie 檔案
斷點續傳 從中斷處繼續下載 false
感知雜湊 啟用相似圖片去重 true
v1.4.0 新增:
URL 檔案 從文本檔案讀取 URL 列表
質量過濾 過濾模糊/無色/水印圖 true
質量閾值 最低質量分 (0-100) 60
AI 分類 按內容自動分類到子目錄 true

步驟 3:執行下載

我會: 1. 抓取網頁 HTML 內容(支援多 URL 批次) 2. 解析所有圖片連結 3. 圖集識別 4. 去重檢測(MD5 + 感知雜湊) 5. 廣告圖過濾 6. 質量過濾(模糊、色彩貧乏、大面積水印) 7. 併發下載到對應資料夾 8. AI 智慧分類(人物/風景/產品/截圖/圖示/文件/插畫) 9. 打包為 ZIP

核心功能

基礎能力

  1. MD5 去重 — 雜湊比對,相同圖片只儲存一份

    來源於7w4.net。

  2. 感知雜湊去重 — 識別縮放/裁剪後的相似圖片
  3. Cookie 支援 — 支援 --cookie--cookie-file
  4. 斷點續傳--resume 引數,中斷後從 session.json 恢復
  5. 語義化命名 — 優先用 alt 文本命名
  6. 併發下載--concurrency 控制併發數
  7. 圖集識別 — 自動識別畫廊/相簿
  8. 尺寸過濾 — 可指定最小/最大圖片尺寸
  9. 廣告過濾 — 自動排除廣告圖片
  10. 增量更新 — 對比已有檔案,只下載新增

v1.4.0 新增

  1. 質量過濾 — 拉普拉斯清晰度檢測 + 色彩豐富度 + 文本水印覆蓋檢測
  2. AI 智慧分類 — 8 類啟發式分析(人物/風景/產品/截圖/圖示/文件/插畫/其他)
  3. 批次 URL — 逗號分隔多 URL + --url-file 檔案輸入

輸出格式

下載完成後生成: - 格式資料夾(JPG/、PNG/、GIF/、WebP/、SVG/、AVIF/、HEIC/、Other/) - AI 分類資料夾(01-人物/、02-風景/、03-產品/、04-截圖/、05-圖示/、06-文件/、07-插畫/、08-其他/) - report.json 下載報告(含質量評分、分類標籤) - session.json 斷點續傳資料 - {域名}.zip 打包檔案

示例

# 基礎下載
下載 https://wallhaven.cc/search?q=landscape

# 質量過濾 + AI 分類
下載 https://example.com/photos,最小 1920px

# Cookie 登入
下載 https://weibo.com/u/123456/album,cookie="SUB=xxx"

# 斷點續傳
下載 https://example.com/gallery,resume

# 高併發快速下載
下載 https://example.com/wallpapers,併發數 8

# v1.4.0: 批次下載多個網站(逗號分隔)
下載 https://site1.com,https://site2.com,https://site3.com/photos

# v1.4.0: 從檔案批次下載
下載 https://example.com,url-file=urls.txt

# v1.4.0: 關閉分類/質量過濾
下載 https://example.com,no-classify,no-quality

命令列參考

python main.py <url | url1,url2,url3> [options]

基礎選項:
  --output=<path>       輸出目錄
  --min-size=<px>       最小尺寸 (預設: 100)
  --max-size=<px>       最大尺寸
  --no-gallery          關閉圖集識別
  --incremental         增量更新
  --concurrency=<n>     併發下載數 (預設: 3)

v1.3.0 新增:
  --cookie="k=v;..."   Cookie 字串
  --cookie-file=<path>  Netscape 格式 Cookie 檔案
  --resume              斷點續傳
  --no-phash            關閉感知雜湊去重
  --phash-threshold=<n> 感知雜湊閾值 (預設: 10)

v1.4.0 新增:
  --url-file=<path>     從檔案讀取 URL 列表
  --no-quality          關閉質量過濾
  --quality-score=<n>   最低質量分 (0-100, 預設: 60)
  --no-classify         關閉 AI 智慧分類

如需使用,請告訴我: 1. 網址:要下載圖片的網頁地址(可多個) 2. 引數(可選):尺寸過濾、Cookie、批次模式等

🤖 AI 評測

這是一款功能豐富的網頁圖片下載器,文件非常詳細齊全,使用說明清晰易懂。優點是功能覆蓋全面(去重、圖集識別、過濾等),配有詳細的使用示例;缺點是存在一些文件與實際內容不一致的小問題,影響使用體驗。總體質量中等偏上,對於需要批次下載網頁圖片的使用者來說是一個可用的工具。

📊 多維度評分

適應性4.4
規範性4.3
有效性4.5
可靠性4.3
可信度4.8

📁 包含檔案 (15 個)

📄 README.md 3.9 KB
📄 SKILL.md 6.3 KB
📄 _skillhub_meta.json 90 B
📄 assets/download-form.html 5.4 KB
📄 evals/evals.json 3 KB
📄 references/api-reference.md 6.9 KB
📄 references/filter-rules.md 4.3 KB
📄 references/output-format.md 4.1 KB
📄 scripts/__init__.py 5.4 KB
📄 scripts/classify.py 11.1 KB
📄 scripts/dedupe.py 2.9 KB
📄 scripts/main.py 30.8 KB
📄 scripts/progress.py 3.7 KB
📄 scripts/quality.py 7.8 KB
📄 scripts/zipper.py 3.8 KB