Agent Skills
› xuiltul/animaworks
› transcribe-tool
transcribe-tool
GitHub基于Whisper的语音转文字工具,支持会议录音、播客转录及音频文件文本提取,可配置语言与模型并选择是否跳过LLM后处理。
Trigger Scenarios
需要转录会议录音
需要将播客或音频文件转换为文本
Install
npx skills add xuiltul/animaworks --skill transcribe-tool -g -y
SKILL.md
Frontmatter
{
"name": "transcribe-tool",
"tags": [
"audio",
"transcription",
"whisper",
"external"
],
"description": "音声文字起こしツール。Whisperで音声ファイルをテキスト化し、必要に応じLLM後処理する。 Use when: 会議録音の転写、ポッドキャストの書き起こし、音声ファイルからテキスト抽出が必要なとき。"
}
Transcribe ツール
Whisper (faster-whisper) を使った音声文字起こしツール。
呼び出し方法
Bash: animaworks-tool transcribe transcribe <音声ファイル> [オプション] で実行
audio — 音声文字起こし
animaworks-tool transcribe transcribe audio_file.wav [-l ja] [-m large-v3-turbo]
パラメータ
| パラメータ | 型 | デフォルト | 説明 |
|---|---|---|---|
| audio_path | string | (必須) | 音声ファイルのパス |
| language | string | null | 言語コード (ja, en 等)。null で自動検出 |
| model | string | "large-v3-turbo" | Whisperモデル名 |
| raw | boolean | false | true の場合、LLM後処理をスキップ |
CLI使用法
animaworks-tool transcribe transcribe audio_file.wav [-l ja] [-m large-v3-turbo]
注意事項
- faster-whisper のインストールが必要
- GPU使用時はCUDA対応の ctranslate2 が必要
- 初回実行時にモデルが自動ダウンロードされる
Version History
- 140e43b Current 2026-07-25 09:13


