本地文字转语音怎么做?用 Piper 生成 WAV 并试听核对

按 Piper 当前官方 CLI 下载示例音色并生成 WAV,试听核对朗读内容、语言支持和模型许可。

想在本机把文字保存成语音文件,可使用 Piper 的命令行版。当前开发已移到 Open Home Foundation 的 piper1-gpl 仓库;旧 rhasspy/piper 仓库已归档。下面按新仓库 CLI 文档,用官方示例英文音色生成 WAV,再听回文字是否读对。中文需要另选支持中文的语音模型,不能把英文模型直接当中文配音工具。

准备隔离环境与音色

安装 Python 后,在独立虚拟环境中安装 piper-tts;下方用 python 命令表示该环境的解释器。运行前先看 Python、pip 与系统是否符合当期发行版要求。

本地文字转语音怎么做?用 Piper 生成 WAV 并试听核对

python -m pip install piper-tts
python -m piper.download_voices

列表会显示可用语音。选一个支持要读文本语言的模型;这里采用官方 CLI 文档里的 en_US-lessac-medium。下载会把模型放在当前目录,另设数据目录时要在后续命令中指定相同位置。

python -m piper.download_voices en_US-lessac-medium

输出 WAV 并试听

运行官方示例命令,-m 指明音色,-f 指定文件。单引号示例在不同终端的转义规则可能不同,复制时看当前 shell;Windows PowerShell 可用双引号包围输入文字。

python -m piper -m en_US-lessac-medium -f test.wav -- "This is a test."

命令成功后检查 test.wav 存在、能播放、声音实际说出 “This is a test.”,并听词尾是否被截断。文件不存在时检查模型是否下载到当前目录;生成文件却无声时检查播放器、系统音量及音频时长。不要在脚本里只判断进程退出码就宣称文字被正确朗读。

换成中文或自己的文本

官方声音列表明确列出简体中文 zh_CN;当前模型仓库有 zh_CN-chaowen-medium 音色。先查看该音色的模型卡,再用与英文例子相同的下载、生成步骤试听一条中文短句:

python -m piper.download_voices zh_CN-chaowen-medium
python -m piper -m zh_CN-chaowen-medium -f chinese-test.wav -- "明天上午十点开会。"

检查 chinese-test.wav 能播放、“十点”是否读对,并用两三句包含数字与专有名词的获授权文本继续试读。不同音色对同一词可能发音不同;不能把 en_US 模型直接喂中文。CLI 每次需要加载模型,官方建议重复调用场景考虑服务接口;本文只演示单次文件输出。

这个例子不是声音克隆,不需要提供他人录音。本文未实测不同硬件的耗时或各音色的自然度;发布和商用前分别核对 Piper 程序与下载音色的许可。

来源与适用范围

以下官方资料核对于 2026 年 10 月 1 日。界面、模型和许可如有变化,以打开时的官方页面为准。

Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/31787.html

赞 (0)
AI小管家的头像AI小管家
开源离线语音识别怎么选?Vosk 与 Whisper 的输入、资源和验证方法
上一篇 2小时前
AI 语音克隆如何工作?从录音样本到合成结果核对
下一篇 2小时前

相关推荐

联系我们

联系我们

1

在线咨询: QQ交谈

邮件:admin@example.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信
关注微信
分享本页
返回顶部