tinker-audio-transcriber
基于 sherpa-onnx 的 TINKER 音频转录插件。

功能特性
- 本地 ASR — 支持 SenseVoice 与 Whisper 模型,无需云端依赖
- 超长媒体支持 — 通过 FFmpeg 处理音频与视频文件
- 语音分段 — 使用 Silero VAD 分割语音并生成带时间轴的字幕列表
- 拖放或选择文件 — 打开媒体文件
- 复制或保存 — 导出纯文本与 SRT 字幕
- 可取消转录 — 实时显示进度
安装
下载并安装 TINKER,然后运行:
bash
npm i -g tinker-audio-transcriber使用方法
- 选择 ASR 模型(SenseVoice 或 Whisper);如有提示则下载模型文件
- 通过拖放或打开按钮选择媒体文件
- 等待识别完成(进度会显示 preparing、VAD、recognizing 等阶段)
- 在结果面板中复制或保存转写文本与 SRT 字幕