name: web-image-downloader description: | 網頁圖片下載器。輸入任意網站地址,自動提取並下載該網頁上所有的圖片。 當用戶說"下載網頁圖片"、"下載這個網站的所有圖片"、"批次下載圖片"、 "下載網頁上的圖片"、"幫我把這個頁面的圖片都下下來"時觸發。 支援 JPG、PNG、GIF、WebP、SVG、AVIF、HEIC 等常見圖片格式。 特性:去重檢測(MD5 + 感知雜湊)、圖集識別、進度顯示、尺寸過濾、廣告過濾、 增量更新、Cookie 登入態支援、斷點續傳、語義化命名、併發下載、質量過濾、AI 智慧分類。 version: 1.4.0
輸入任意網站地址,自動下載該網頁上所有的圖片,按型別/AI 智慧分類並打包為 ZIP。
web-image-downloader/ ├── SKILL.md <- 主入口(本檔案) ├── references/ <- 詳細參考文件 │ ├── filter-rules.md <- 過濾規則詳解 │ ├── api-reference.md <- 技術介面文件 │ └── output-format.md <- 輸出格式說明 ├── scripts/ <- 可執行指令碼 │ ├── main.py <- 主下載指令碼 │ ├── dedupe.py <- 去重指令碼 (MD5 + pHash) │ ├── quality.py <- 質量過濾指令碼 (v1.4.0) │ ├── classify.py <- AI 智慧分類指令碼 (v1.4.0) │ ├── progress.py <- 進度條指令碼 │ └── zipper.py <- ZIP 打包指令碼 ├── assets/ <- 靜態資源 │ └── download-form.html └── evals/ └── evals.json小蔥技能7w4.net有完整的技能分類。
輸入目標網頁的完整 URL,或多個 URL(逗號分隔 / URL 檔案)。
| 引數 | 說明 | 預設值 |
|---|---|---|
| 儲存路徑 | 圖片儲存位置 | Downloads/web-images/[域名]/ |
| 最小尺寸 | 寬度或高度 >= 此值(px) | 100 |
| 最大尺寸 | 寬度或高度 <= 此值(px) | 不限制 |
| 圖集識別 | 識別並下載圖片集 | true |
| 增量更新 | 對比已有檔案,只下載新增 | false |
| 併發數 | 同時下載的執行緒數 | 3 |
| Cookie | 登入態 Cookie 字串 | 無 |
| Cookie 檔案 | Netscape 格式 Cookie 檔案 | 無 |
| 斷點續傳 | 從中斷處繼續下載 | false |
| 感知雜湊 | 啟用相似圖片去重 | true |
| v1.4.0 新增: | ||
| URL 檔案 | 從文本檔案讀取 URL 列表 | 無 |
| 質量過濾 | 過濾模糊/無色/水印圖 | true |
| 質量閾值 | 最低質量分 (0-100) | 60 |
| AI 分類 | 按內容自動分類到子目錄 | true |
我會: 1. 抓取網頁 HTML 內容(支援多 URL 批次) 2. 解析所有圖片連結 3. 圖集識別 4. 去重檢測(MD5 + 感知雜湊) 5. 廣告圖過濾 6. 質量過濾(模糊、色彩貧乏、大面積水印) 7. 併發下載到對應資料夾 8. AI 智慧分類(人物/風景/產品/截圖/圖示/文件/插畫) 9. 打包為 ZIP
--cookie 和 --cookie-file--resume 引數,中斷後從 session.json 恢復--concurrency 控制併發數--url-file 檔案輸入下載完成後生成:
- 格式資料夾(JPG/、PNG/、GIF/、WebP/、SVG/、AVIF/、HEIC/、Other/)
- AI 分類資料夾(01-人物/、02-風景/、03-產品/、04-截圖/、05-圖示/、06-文件/、07-插畫/、08-其他/)
- report.json 下載報告(含質量評分、分類標籤)
- session.json 斷點續傳資料
- {域名}.zip 打包檔案
# 基礎下載
下載 https://wallhaven.cc/search?q=landscape
# 質量過濾 + AI 分類
下載 https://example.com/photos,最小 1920px
# Cookie 登入
下載 https://weibo.com/u/123456/album,cookie="SUB=xxx"
# 斷點續傳
下載 https://example.com/gallery,resume
# 高併發快速下載
下載 https://example.com/wallpapers,併發數 8
# v1.4.0: 批次下載多個網站(逗號分隔)
下載 https://site1.com,https://site2.com,https://site3.com/photos
# v1.4.0: 從檔案批次下載
下載 https://example.com,url-file=urls.txt
# v1.4.0: 關閉分類/質量過濾
下載 https://example.com,no-classify,no-quality
python main.py <url | url1,url2,url3> [options]
基礎選項:
--output=<path> 輸出目錄
--min-size=<px> 最小尺寸 (預設: 100)
--max-size=<px> 最大尺寸
--no-gallery 關閉圖集識別
--incremental 增量更新
--concurrency=<n> 併發下載數 (預設: 3)
v1.3.0 新增:
--cookie="k=v;..." Cookie 字串
--cookie-file=<path> Netscape 格式 Cookie 檔案
--resume 斷點續傳
--no-phash 關閉感知雜湊去重
--phash-threshold=<n> 感知雜湊閾值 (預設: 10)
v1.4.0 新增:
--url-file=<path> 從檔案讀取 URL 列表
--no-quality 關閉質量過濾
--quality-score=<n> 最低質量分 (0-100, 預設: 60)
--no-classify 關閉 AI 智慧分類
如需使用,請告訴我: 1. 網址:要下載圖片的網頁地址(可多個) 2. 引數(可選):尺寸過濾、Cookie、批次模式等
這是一款功能豐富的網頁圖片下載器,文件非常詳細齊全,使用說明清晰易懂。優點是功能覆蓋全面(去重、圖集識別、過濾等),配有詳細的使用示例;缺點是存在一些文件與實際內容不一致的小問題,影響使用體驗。總體質量中等偏上,對於需要批次下載網頁圖片的使用者來說是一個可用的工具。