name: local-whisper description: Local speech-to-text using OpenAI Whisper. Runs fully offline after model download. High quality transcription with multiple model sizes. metadata: {"clawdbot":{"emoji":"🎙️","requires":{"bins":["ffmpeg"]}}}
Local speech-to-text using OpenAI's Whisper. Fully offline after initial model download.
# Basic
~/.clawdbot/skills/local-whisper/scripts/local-whisper audio.wav
# Better model
~/.clawdbot/skills/local-whisper/scripts/local-whisper audio.wav --model turbo
# With timestamps
~/.clawdbot/skills/local-whisper/scripts/local-whisper audio.wav --timestamps --json
| Model | Size | Notes |
|---|---|---|
tiny |
39M | Fastest |
base |
74M | Default |
small |
244M | Good balance |
turbo |
809M | Best speed/quality |
large-v3 |
1.5GB | Maximum accuracy |
--model/-m — Model size (default: base)--language/-l — Language code (auto-detect if omitted)--timestamps/-t — Include word timestamps--json/-j — JSON output--quiet/-q — Suppress progressUses uv-managed venv at .venv/. To reinstall:
cd ~/.clawdbot/skills/local-whisper
uv venv .venv --python 3.12
uv pip install --python .venv/bin/python click openai-whisper torch --index-url https://download.pytorch.org/whl/cpu
这是一款实用的本地语音转文字工具,离线即可使用,安装配置有文档指导。整体质量良好,核心转录功能稳定可靠,支持多种输出格式和模型选择。优点是操作简单、结果准确、无需联网;缺点是初次配置需要安装多个依赖项,新手可能遇到困难,且没有提供测试用的示例音频文件。适合有技术基础的用户使用。