Edge-TTS Skill

8小时前发布 0 0 0

用 node-edge-tts 把文本转为多语言语音,控制音色、语速、音高、音量、格式与字幕。

收录时间:
2026-09-24

Edge-TTS Skill 是什么

将文字生成 MP3 等语音文件,简单需求可走内置 TTS,定制需求则调用 Node 脚本选择音色和韵律并保存字幕。

适用场景

适合无障碍朗读、语音消息、教程、故事、新闻摘要、演示配音和多语言试听。

核心能力与工作机制

清单提供多语种音色、语速建议、音高音量、代理与超时、格式选择、字幕 JSON、声音列表和配置管理。

执行流程

确认文本、语言、音色和使用场景,选择内置工具或 converter;生成短样试听,调整 rate/pitch/volume 后输出目标格式和可选字幕。

输入与输出

需要文本、语言、音色、语速、音高、音量、输出格式和文件路径。输出音频文件、媒体路径和可选字幕 JSON。

依赖、账号与权限

高级模式依赖 Node.js、node-edge-tts、commander 和网络;部分环境可能需要代理。

副作用、限制与风险

云端语音服务会接收文本,长文本可能超时或分段不自然;音色可用性和服务行为会变化。会向外部 TTS 服务发送文本并在本地写入音频、字幕和配置。

不适用边界

不是声音克隆或专业录音棚,也不保证所有音色、格式和商用权利长期可用。

失败处理与验收

先测试短句和列出音色,检查网络、代理、超时与依赖;长文本应分段后再拼接。实际播放检查语言、发音、停顿、响度和文件编码,并抽查字幕时间与文本一致。

适合谁使用

适合内容创作者、无障碍工具开发者和需要程序化配音的用户。

来源、版本与许可

本条目依据 SkillHub 热门榜、发布者详情和版本 2.0.0 的完整 SKILL.md 整理,核验日期为 2026 年 9 月 21 日。完整 SKILL.md 未声明许可证,公开可下载不代表可以任意复制、修改或再分发。 SkillHub 当前两套安全扫描状态为 benign、benign;该状态只是平台信号,不能替代对脚本、凭据、网络请求、数据外送与后续版本的人工审查。

常见问题

1. Edge-TTS Skill 主要解决什么问题?

将文字生成 MP3 等语音文件,简单需求可走内置 TTS,定制需求则调用 Node 脚本选择音色和韵律并保存字幕。适合无障碍朗读、语音消息、教程、故事、新闻摘要、演示配音和多语言试听。是否采用它,应以实际任务边界和可核验材料为准,不要因为榜单热度而跳过来源审查。

2. 开始前需要准备什么?

需要文本、语言、音色、语速、音高、音量、输出格式和文件路径。准备阶段不要代替用户猜测关键事实;缺少会改变路线、费用或权限的输入时,应先补齐再执行。

3. 它怎样完成任务并交付结果?

确认文本、语言、音色和使用场景,选择内置工具或 converter;生成短样试听,调整 rate/pitch/volume 后输出目标格式和可选字幕。每个阶段都要保留输入、决策、输出和检查点,不能把计划、预览或排队状态描述成最终交付。

4. 需要哪些工具、账号或权限?

高级模式依赖 Node.js、node-edge-tts、commander 和网络;部分环境可能需要代理。凭据应放在安全环境中,并按最小权限授权;账号、网络或本地依赖不满足时应明确停止条件。

5. 它会产生哪些外部操作或副作用?

会向外部 TTS 服务发送文本并在本地写入音频、字幕和配置。涉及外部写入、上传、发送、付费或持久配置时,应在实际动作前说明影响范围并取得相应确认。

6. 哪些情况不适合使用?

不是声音克隆或专业录音棚,也不保证所有音色、格式和商用权利长期可用。超出来源明确能力、专业资质或授权范围时,应切换到更合适的工具或交给专业人员处理。

7. 失败或结果异常时怎样恢复?

先测试短句和列出音色,检查网络、代理、超时与依赖;长文本应分段后再拼接。恢复时优先查询已有任务、日志或备份,避免无上限重试、重复扣费、重复发送或覆盖唯一原件。

8. 如何验收结果并控制风险?

实际播放检查语言、发音、停顿、响度和文件编码,并抽查字幕时间与文本一致。验收应基于真实文件、页面、任务终态或权威来源,并把未能实际检查的部分明确标记出来。

数据统计

相关导航

暂无评论

none
暂无评论...