各位大神。本人是渐冻症患者。现已经失语。在不能说话前。已经将自己的声音录制下来。苦于国内没有语音银行。无法将中文语音制作成SAPI5的格式。需要把我的mp3语音录音AI 语音接到 Windows 的 SAPI5 里让软件直接调用 红包感谢
MP3的内容和音质是什么怎么样
有两个方案,1、一个你的方案需要你的MP3文件包含了常用字词,但MP3中没有的字词发不了音2、rvc方案,最好需要10-30min的清晰无背景音的原始录音。再拿到rvc项目里训出pth,这样可以做出你的ai语音。我的硬件不行,恐怕难以提供帮助,只能提供些许思路
已转发,期待有大神回复
首先对于你的病症我感到十分悲痛,我大致了解了一下你的需求,这的确触及我的知识盲区,尤其是SAPI5,是我从未了解的领域,希望能够有了解的用户给予帮助
mp3.还是清楚吧。谢谢
你好。请问知道有制作的公司吗
你的需求是 以后微信聊天这种能把文字转成语音发出去吗?
你需要 indextts
感谢各位大佬鼎力相助
不是的。我用的是特殊的电脑。用眼睛控制电脑。里面有特定的发声软件。该软件调用win里面的声音。我现在想把我自己的声音安装到win系统里。需要有sapi5接口
因为是特殊的电脑。配置很差。带不动语音模型
看到你的帖子,非常理解你的处境。我是15794(失语辅助工具KineTap)的作者。
你的需求是把录音做成SAPI5格式让Windows系统调用,这需要语音克隆+SAPI5引擎开发,技术难度确实很高,特别是SAPI5驱动签名和系统兼容性这块。
但我想试试帮你。我打算用AI工具(SOLO)辅助开发:
- 先用你的录音训练语音克隆模型(GPT-SoVITS/RVC)
- 尝试做SAPI5引擎接入,如果系统级方案走不通,至少做一个独立工具让你能在常用软件里使用自己的声音
需要你提供:
- 录音时长和音质(10分钟以上、安静环境最佳)
- 以及主要想在哪些软件里使用?
这不是承诺一定能成,但我会尽力试试。可以先发一段录音给我看看质量吗?(微信账号:yaohewoma)
SAPI5并不是我了解的技术,克隆音色有很多选择,想要私有化训练和部署一个语音模型实在是过于困难,但是有很多开源或者商业的语音克隆模型可以使用,可以封装成一个小的工具,这样至少能做到从文字转换到你的声音,而且并不困难,如果这符合你的需求你也可以直接在平台上私信联系我,我是软件工程专业的学生,我能提供一些技术的帮助
其实私有化部署一个轻量级的TTS模型也可以,我也是最近才了解到的一些轻量化的TTS开源模型,像是Supertonic、NeuTTS Air都是可以在本地运行甚至在移动端运行的语言模型,但是效果怎么样我还没有尝试过