name: 圖片工具集 description: 包括通用文本識別、手寫識別、車牌識別、身份證識別、日常物體檢測、昆蟲識別、植物識別、護照識別、港澳臺通行證識別、銀行卡識別、營業執照識別、駕駛證識別、行駛證識別、動物識別、電動腳踏車檢測、手機檢測、手勢檢測、火焰檢測、香菸檢測、人頭人體檢測、野生動物檢測、鳥類識別、寵物情緒識別和萬物識別。 version: 1.0.2 slug: pic displayName: 圖片工具集 summary: 包括通用文本識別、手寫識別、車牌識別、身份證識別、日常物體檢測、昆蟲識別、植物識別、護照識別、港澳臺通行證識別、銀行卡識別、營業執照識別、駕駛證識別、行駛證識別、動物識別、電動腳踏車檢測、手機檢測、手勢檢測、火焰檢測、香菸檢測、人頭人體檢測、野生動物檢測、鳥類識別、寵物情緒識別和萬物識別。 license: MIT
包括通用文本識別、手寫識別、車牌識別、身份證識別、日常物體檢測、昆蟲識別、植物識別、護照識別、港澳臺通行證識別、銀行卡識別、營業執照識別、駕駛證識別、行駛證識別、動物識別、電動腳踏車檢測、手機檢測、手勢檢測、火焰檢測、香菸檢測、人頭人體檢測、野生動物檢測、鳥類識別、寵物情緒識別和萬物識別。
此 Skill 必須配置 API 金鑰才能使用。
.env 中沒有 XBY_APIKEY,必須使用 AskUserQuestion 工具向用戶詢問 API 金鑰scripts.config.set_api_key(api_key) 儲存,然後繼續處理你(大模型)是路由層,負責理解使用者意圖、選擇工具、提取引數。程式碼只負責呼叫API。
使用者輸入 → 你選擇工具 → 提取該工具需要的引數 → 呼叫 scripts.tools 中的函式 → 返回結果給使用者
scripts.config.settings.api_key 為空,使用 AskUserQuestion 詢問使用者,拿到後呼叫 scripts.config.set_api_key(key) 儲存scripts.tools 中的函式,例如 scripts.tools.search_schools(score='520', province='北京', category='綜合')raw 資料整理後展示給使用者根據使用者意圖選擇對應的工具函式:
| 使用者意圖 | 工具函式 |
|---|---|
| 兼顧速度與精度的文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案連結。 | scripts.tools.ocr |
| 兼顧速度與精度的文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_for_data_base64 |
| 高精度文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案連結。 | scripts.tools.ocr_pro |
| 高精度文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_pro_for_data_base64 |
| 輸入包含手寫文本的影像,自動檢測文本行並識別內容。適用於手寫筆記、簽名、手寫表單等。 需要輸入圖片檔案連結。 | scripts.tools.ocr_handwriting |
| 輸入包含手寫文本的影像,自動檢測文本行並識別內容。適用於手寫筆記、簽名、手寫表單等。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_handwriting_for_data_base64 |
| 識別車牌號、車牌顏色、單/雙層車牌、位置框。 需要輸入圖片檔案連結。 | scripts.tools.plate_recognition |
| 識別車牌號、車牌顏色、單/雙層車牌、位置框。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.plate_recognition_for_data_base64 |
| 識別銀行卡號、髮卡銀行和卡型別,使用 Luhn 演算法校驗卡號有效性。 需要輸入圖片檔案連結。 | scripts.tools.ocr_bank_card |
| 識別銀行卡號、髮卡銀行和卡型別,使用 Luhn 演算法校驗卡號有效性。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_bank_card_for_data_base64 |
| 識別營業執照的統一社會信用程式碼、名稱、法定代表人、註冊資本、成立日期、經營範圍、登記機關和住所地址。 需要輸入圖片檔案連結。 | scripts.tools.ocr_biz_license |
| 識別營業執照的統一社會信用程式碼、名稱、法定代表人、註冊資本、成立日期、經營範圍、登記機關和住所地址。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_biz_license_for_data_base64 |
| 識別駕駛證主頁(證號、姓名、性別、國籍、住址、出生日期、準駕車型、初次領證日期、有效期限)和副頁(檔案編號)。 需要輸入圖片檔案連結。 | scripts.tools.ocr_driver_license |
| 識別駕駛證主頁(證號、姓名、性別、國籍、住址、出生日期、準駕車型、初次領證日期、有效期限)和副頁(檔案編號)。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_driver_license_for_data_base64 |
| 識別機動車行駛證的號牌號碼、車輛型別、所有人、住址、品牌型號、發動機號碼、車輛識別代號等資訊,支援自動方向檢測和主副頁過濾。 需要輸入圖片檔案連結。 | scripts.tools.ocr_vehicle_license |
| 識別機動車行駛證的號牌號碼、車輛型別、所有人、住址、品牌型號、發動機號碼、車輛識別代號等資訊,支援自動方向檢測和主副頁過濾。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_vehicle_license_for_data_base64 |
| 識別身份證正面(姓名、性別、民族、出生日期、住址、身份證號)和背面(簽發機關、有效期限),自動判斷正反面並校驗身份證號有效性。 需要輸入圖片檔案連結。 | scripts.tools.ocr_id_card |
| 識別身份證正面(姓名、性別、民族、出生日期、住址、身份證號)和背面(簽發機關、有效期限),自動判斷正反面並校驗身份證號有效性。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_id_card_for_data_base64 |
| 識別港澳通行證、臺灣通行證的通行證號碼、姓名、性別、出生日期、有效期、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案連結。 | scripts.tools.ocr_pass |
| 識別港澳通行證、臺灣通行證的通行證號碼、姓名、性別、出生日期、有效期、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_pass_for_data_base64 |
| 識別護照號碼、中文姓名、英文姓名、性別、國籍、出生日期、簽發日期、有效期至、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案連結。 | scripts.tools.ocr_passport |
| 識別護照號碼、中文姓名、英文姓名、性別、國籍、出生日期、簽發日期、有效期至、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ocr_passport_for_data_base64 |
| 輸入一張影像,對其中的人/寵物/車/火焰/紙箱進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。 | scripts.tools.daily_object_detection |
| 輸入一張影像,對其中的人/寵物/車/火焰/紙箱進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.daily_object_detection_for_data_base64 |
| 識別昆蟲或其他節肢動物名稱(或所屬目, 科, 屬, 種)。 需要輸入圖片檔案連結。 | scripts.tools.insect_recognition |
| 識別昆蟲或其他節肢動物名稱(或所屬目, 科, 屬, 種)。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.insect_recognition_for_data_base64 |
| 識別植物名稱(或所屬科, 屬, 種或亞種)。 需要輸入圖片檔案連結。 | scripts.tools.plant_recognition |
| 識別植物名稱(或所屬科, 屬, 種或亞種)。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.plant_recognition_for_data_base64 |
| 對含有動物的影像進行標籤識別,無需任何額外輸入,輸出動物的類別標籤。 需要輸入圖片檔案連結。 | scripts.tools.animal_recognition |
| 對含有動物的影像進行標籤識別,無需任何額外輸入,輸出動物的類別標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.animal_recognition_for_data_base64 |
| 輸入一張影像,對其中的手機進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。 | scripts.tools.cellphone_detection |
| 輸入一張影像,對其中的手機進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.cellphone_detection_for_data_base64 |
| 輸入一張影像,對其中的電動腳踏車進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。 | scripts.tools.ebike_detection |
| 輸入一張影像,對其中的電動腳踏車進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.ebike_detection_for_data_base64 |
| 檢測各類通用場景中出現的火焰,最佳使用場景:安防攝像頭、交通攝像頭視角。 需要輸入圖片檔案連結。 | scripts.tools.fire_detection |
| 檢測各類通用場景中出現的火焰,最佳使用場景:安防攝像頭、交通攝像頭視角。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.fire_detection_for_data_base64 |
| 對包含主體物體的影像進行標籤識別,輸出主體物體的類別標籤,目前已經覆蓋了5萬多類的物體類別。 需要輸入圖片檔案連結。 | scripts.tools.general_recognition |
| 對包含主體物體的影像進行標籤識別,輸出主體物體的類別標籤,目前已經覆蓋了5萬多類的物體類別。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.general_recognition_for_data_base64 |
| 輸入一張影像,對其中的手勢進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。 | scripts.tools.gesture_detection |
| 輸入一張影像,對其中的手勢進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.gesture_detection_for_data_base64 |
| 輸入一張影像,對其中的人頭人體進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。 | scripts.tools.head_person_detection |
| 輸入一張影像,對其中的人頭人體進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.head_person_detection_for_data_base64 |
| 輸入一張影像,對其中的香菸目標進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。 | scripts.tools.smoking_detection |
| 輸入一張影像,對其中的香菸目標進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.smoking_detection_for_data_base64 |
| 輸入一張影像,輸出影像中所有識別到的野生動物的檢測框、置信度及標籤。 需要輸入圖片檔案連結。 | scripts.tools.wild_animals_detection |
| 輸入一張影像,輸出影像中所有識別到的野生動物的檢測框、置信度及標籤。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.wild_animals_detection_for_data_base64 |
| 檢測並識別圖片中的鳥類。 需要輸入圖片檔案連結。 | scripts.tools.bird_detection |
| 檢測並識別圖片中的鳥類。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.bird_detection_for_data_base64 |
| 識別寵物面部表情,輸出 4 類情緒: Angry / Happy / Relaxed / Sad。 需要輸入圖片檔案連結。 | scripts.tools.pet_emotion_recognition |
| 識別寵物面部表情,輸出 4 類情緒: Angry / Happy / Relaxed / Sad。 需要輸入圖片檔案的BASE64編碼。 | scripts.tools.pet_emotion_recognition_for_data_base64 |
如果引數不完整,使用 AskUserQuestion 向用戶詢問缺失的引數。
工具描述:兼顧速度與精度的文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:兼顧速度與精度的文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:高精度文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:高精度文字識別。輸入包含文本的影像,自動檢測並識別內容。適用於各類文件、廣告牌、螢幕截圖等場景。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入包含手寫文本的影像,自動檢測文本行並識別內容。適用於手寫筆記、簽名、手寫表單等。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入包含手寫文本的影像,自動檢測文本行並識別內容。適用於手寫筆記、簽名、手寫表單等。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別車牌號、車牌顏色、單/雙層車牌、位置框。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別車牌號、車牌顏色、單/雙層車牌、位置框。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別銀行卡號、髮卡銀行和卡型別,使用 Luhn 演算法校驗卡號有效性。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別銀行卡號、髮卡銀行和卡型別,使用 Luhn 演算法校驗卡號有效性。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別營業執照的統一社會信用程式碼、名稱、法定代表人、註冊資本、成立日期、經營範圍、登記機關和住所地址。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別營業執照的統一社會信用程式碼、名稱、法定代表人、註冊資本、成立日期、經營範圍、登記機關和住所地址。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別駕駛證主頁(證號、姓名、性別、國籍、住址、出生日期、準駕車型、初次領證日期、有效期限)和副頁(檔案編號)。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別駕駛證主頁(證號、姓名、性別、國籍、住址、出生日期、準駕車型、初次領證日期、有效期限)和副頁(檔案編號)。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別機動車行駛證的號牌號碼、車輛型別、所有人、住址、品牌型號、發動機號碼、車輛識別代號等資訊,支援自動方向檢測和主副頁過濾。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別機動車行駛證的號牌號碼、車輛型別、所有人、住址、品牌型號、發動機號碼、車輛識別代號等資訊,支援自動方向檢測和主副頁過濾。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別身份證正面(姓名、性別、民族、出生日期、住址、身份證號)和背面(簽發機關、有效期限),自動判斷正反面並校驗身份證號有效性。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別身份證正面(姓名、性別、民族、出生日期、住址、身份證號)和背面(簽發機關、有效期限),自動判斷正反面並校驗身份證號有效性。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別港澳通行證、臺灣通行證的通行證號碼、姓名、性別、出生日期、有效期、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別港澳通行證、臺灣通行證的通行證號碼、姓名、性別、出生日期、有效期、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別護照號碼、中文姓名、英文姓名、性別、國籍、出生日期、簽發日期、有效期至、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別護照號碼、中文姓名、英文姓名、性別、國籍、出生日期、簽發日期、有效期至、簽發地點等資訊,支援MRZ機讀碼解析。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入一張影像,對其中的人/寵物/車/火焰/紙箱進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入一張影像,對其中的人/寵物/車/火焰/紙箱進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別昆蟲或其他節肢動物名稱(或所屬目, 科, 屬, 種)。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別昆蟲或其他節肢動物名稱(或所屬目, 科, 屬, 種)。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別植物名稱(或所屬科, 屬, 種或亞種)。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別植物名稱(或所屬科, 屬, 種或亞種)。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:對含有動物的影像進行標籤識別,無需任何額外輸入,輸出動物的類別標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:對含有動物的影像進行標籤識別,無需任何額外輸入,輸出動物的類別標籤。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入一張影像,對其中的手機進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入一張影像,對其中的手機進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入一張影像,對其中的電動腳踏車進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入一張影像,對其中的電動腳踏車進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:檢測各類通用場景中出現的火焰,最佳使用場景:安防攝像頭、交通攝像頭視角。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:檢測各類通用場景中出現的火焰,最佳使用場景:安防攝像頭、交通攝像頭視角。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:對包含主體物體的影像進行標籤識別,輸出主體物體的類別標籤,目前已經覆蓋了5萬多類的物體類別。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:對包含主體物體的影像進行標籤識別,輸出主體物體的類別標籤,目前已經覆蓋了5萬多類的物體類別。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入一張影像,對其中的手勢進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入一張影像,對其中的手勢進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入一張影像,對其中的人頭人體進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入一張影像,對其中的人頭人體進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入一張影像,對其中的香菸目標進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入一張影像,對其中的香菸目標進行檢測,輸出圖片中所有目標的檢測框、置信度和標籤。 需要輸入圖片檔案的BASE64編碼。
來源於7w4.net。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:輸入一張影像,輸出影像中所有識別到的野生動物的檢測框、置信度及標籤。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:輸入一張影像,輸出影像中所有識別到的野生動物的檢測框、置信度及標籤。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:檢測並識別圖片中的鳥類。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:檢測並識別圖片中的鳥類。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具描述:識別寵物面部表情,輸出 4 類情緒: Angry / Happy / Relaxed / Sad。 需要輸入圖片檔案連結。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataUrl | string | true | 圖片檔案連結地址 |
工具描述:識別寵物面部表情,輸出 4 類情緒: Angry / Happy / Relaxed / Sad。 需要輸入圖片檔案的BASE64編碼。
| 引數名稱 | 引數型別 | 是否必填 | 預設值 | 描述 |
|---|---|---|---|---|
| dataBase64 | string | true | base64 encoded data of image file |
工具函式返回 dict 物件:
- result["raw"] - API 原始返回資料(JSON),直接將此資料整理後展示給使用者
- result["success"] - 是否成功(True/False)
- result["message"] - 狀態訊息
./
├── scripts/
│ ├── __init__.py
│ ├── config.py # 配置管理 + set_api_key()
│ ├── call_api.py # API 客戶端 + call_api()
│ └── tools.py # 工具函式(直接呼叫)
├── requirements.txt
└── SKILL.md
這是一款功能豐富的圖片識別工具,涵蓋文字提取、證件識別、動植物分類等日常場景,質量穩定,文件清晰,使用門檻低。優點是功能覆蓋面廣、介面統一、上手容易;不足是依賴外部 API 服務穩定性,且部分細分功能(如昆蟲識別、野生動物檢測)的準確性受限於訓練資料。總體而言,適合需要快速整合圖片識別能力的場景,但對精度要求極高的專業領域需謹慎評估。