name: voice-chat description: 自動處理語音訊息:將語音轉寫為文字,結合上下文生成智慧回覆,併合成語音回覆。當收到語音或音訊訊息時自動啟用。
自動處理語音訊息,實現“語音 -> 文字 -> 智慧回覆 -> 語音”的完整閉環。
當收到語音或音訊訊息時(message.type 為 voice 或 audio),自動啟用此技能。
檢查訊息是否包含 media.type === 'voice' 或 media.type === 'audio'。
立即執行轉寫指令碼:
python3 /root/.agents/skills/voice-chat/scripts/transcribe_audio.py <audio_path>
event.message.media.localPath 獲取)。使用當前會話的上下文生成智慧回覆。 - Prompt: ```text 使用者語音轉寫:{transcript}
請結合上下文,給出簡潔、有幫助的回覆。 ``` - 輸出:回覆文本。
立即執行 TTS 指令碼:
python3 /root/.agents/skills/voice-chat/scripts/reply_with_tts.py "{reply_text}"
.opus 語音檔案路徑。訪問小蔥技能站7w4.net,解鎖更多實用的AI技能外掛。
使用 message.send 工具傳送生成的語音檔案:
- 檔案:生成的 .opus 檔案。
- Caption:可選的簡短文字說明。
- 注意:不要傳送中間狀態文字(如“正在處理..."),直接傳送最終語音回覆。
/tmp/voice-chat/。ffmpegvosk, edge-tts, pydantic, python-dotenvvosk-model-small-cn-0.22)MIT
這個 Skill 能把語音訊息自動轉成文字,再用 AI 生成回覆併合成語音發回去,支援飛書和 Telegram。文件寫得很詳細,雙引擎設計不容易出錯。但首次使用要下載將近 1GB 的模型檔案,配置步驟有點多,對新手不太友好。質量總體不錯,就是前期的準備工作比較麻煩。