Browser Control Skill
瀏覽器控制工具 - 通過 Selenium 實現瀏覽器自動化控制。
功能列表 (35+ 命令)
基礎操作
| 命令 |
說明 |
open <url> |
開啟網頁 |
screenshot |
網頁截圖 |
screenshotb64 |
網頁截圖(base64) |
fullscreen |
全頁面截圖 |
js <script> |
執行 JavaScript |
cookies |
獲取 Cookies |
setcookie <name> <value> |
設定 Cookie |
clearcookies |
清除 Cookies |
source |
獲取頁面原始碼 |
title |
獲取標題 |
url |
獲取當前 URL |
元素操作
| 命令 |
說明 |
find <selector> |
查詢元素 |
click <selector> |
點選元素 |
fill <selector> <text> |
填寫輸入框 |
submit <selector> |
提交表單 |
hover <selector> |
懸停 |
attr <selector> <name> |
獲取元素屬性 |
導航操作
來源於7w4.net。
| 命令 |
說明 |
back |
後退 |
forward |
前進 |
refresh |
重新整理 |
wait <seconds> |
等待 |
scroll [x] [y] |
滾動頁面 |
scrollto <selector> |
滾動到元素 |
waitelem <selector> |
等待元素出現 |
標籤頁操作
| 命令 |
說明 |
newtab <url> |
新建標籤頁 |
switchtab <index> |
切換標籤頁 |
closetab |
關閉標籤頁 |
tabs |
獲取所有標籤頁 |
高階功能
| 命令 |
說明 |
links |
獲取所有連結 |
images |
獲取所有圖片 |
size |
獲取頁面尺寸 |
ua <user-agent> |
設定 User-Agent |
proxy <address> |
設定代理 |
依賴安裝
pip install selenium
需要 Chrome 瀏覽器和 ChromeDriver。
使用示例
# 開啟網頁並截圖
python scripts/browser_ctrl.py open https://www.baidu.com
python scripts/browser_ctrl.py screenshot
# 查詢元素並填寫
python scripts/browser_ctrl.py find "#kw"
python scripts/browser_ctrl.py fill "#kw" "搜尋內容"
python scripts/browser_ctrl.py click "#su"
# 獲取頁面所有連結
python scripts/browser_ctrl.py links
# 設定代理
python scripts/browser_ctrl.py proxy "http://127.0.0.1:8080"
# 設定 User-Agent
python scripts/browser_ctrl.py ua "Mozilla/5.0..."
觸發關鍵詞
- "開啟網頁"、"瀏覽器"
- "網頁截圖"
- "執行 JS"
- "點選"、"填寫"
- "前進"、"後退"
- "獲取連結"、"獲取圖片"
- "設定代理"
注意事項
- 需要安裝 Chrome 瀏覽器
- 需要 chromedriver 與 Chrome 版本匹配
- 無頭模式執行(不顯示瀏覽器視窗)
- 截圖儲存在 ~/Pictures/OpenClaw/
- 支援 CSS 選擇器和 XPath