Openai Whisper Skill

21小时前发布 2 0 0

使用本地Whisper CLI转录音频并生成文本或字幕的Skill。

收录时间:
2026-09-01

Openai Whisper Skill 是什么?

Openai Whisper Skill 使用本地 Whisper CLI 把音频转成文字。它支持常见音频文件,能够输出纯文本或字幕,也可以把其他语言的语音翻译为英文。转录在本机运行,不需要调用云端 API。

主要能力

  • 将 MP3、M4A 等音频转录为文字。
  • 输出 TXT 或 SRT 字幕文件。
  • 在支持的语言范围内执行语音翻译任务。
  • 按速度、显存和准确率需求选择不同模型。

安装与首次运行

使用前需要安装 whisper 命令及其运行依赖。首次选择某个模型时,程序会下载模型文件到本地缓存,因此需要网络和足够磁盘空间。目录中的安装说明默认模型可能随安装包变化,运行前应查看当前版本帮助。

模型选择

较小模型下载快、占用资源少,适合快速草稿;较大模型通常需要更多内存和计算时间。音频噪声、口音、多人重叠说话和专业术语会影响结果,重要内容应人工校对。

隐私与限制

本地处理可以减少音频上传,但模型下载和安装仍会访问外部来源。敏感录音应保存在受控目录,字幕与转写结果也可能包含个人信息。该 Skill 不提供说话人分离或专业法律记录保证。

许可证

ClawHub 当前版本没有声明许可证。Whisper 软件、模型和输入音频分别受各自许可证与权利限制。

常见问题 FAQ

1. 需要 OpenAI API Key 吗?

不需要,目录说明使用本地 Whisper CLI。

2. 第一次运行为什么很慢?

可能正在下载所选模型,下载完成后会保存在本地缓存。

3. 能生成字幕吗?

可以输出 SRT 等字幕格式。

4. 可以把中文语音翻译成英文吗?

可以使用翻译任务,但结果仍需根据音质和内容校对。

5. 模型越大越好吗?

较大模型通常更耗资源,应根据准确率、速度和设备能力选择。

6. 音频会上传到云端吗?

转录在本地执行,但安装和模型下载会访问外部资源。

7. 能区分不同说话人吗?

该目录说明没有提供完整的说话人分离流程。

8. 转录结果可以直接用于正式记录吗?

重要会议、法律或医疗内容应由人工核对,不能只依赖自动转录。

来源与核验说明

本条目根据 ClawHub 上 steipete 发布的 Openai Whisper 1.0.0 内容整理,发布前已核对本地依赖和隐私边界。

数据统计

相关导航

暂无评论

none
暂无评论...