8 阿飞哥 3周前 288次点击
大家好,我是飞言语音库的站长阿飞哥。今天来简单几步教大家如何创建自己的自定义音色。
在创建自定义音色之前,有两个前提条件,大家得记牢,避免浪费额度和浪费时间。1参考音频,请保证参考音频内有清晰的人声,不要有杂音。可以有纯背景音乐,但不能有歌声,以及能盖过人声的背景音乐。理由,你也不想你创建出来的音色夹杂着其他莫名其妙的声音吧?为了避免质量下降,大家得 认真的对待自己要提供创建音色的音频样本的质量,不需要搞得跟朗诵似的,字正腔圆。起码基本的口齿清晰和人声清晰这两点要素得有吧,否则模型怎么学你的说话习惯?怎么学你的口癖?
2音频时长音频时长最好是30秒以上的。MiniMax 这个模型最大能上传5分钟的音频。但也不是音频时长越长越好。如何查看自己的音频时长有没有满足要求呢?大家可用落寞工具箱的视频转音频上传,你要 作为素材的音频或视频,即可看到音频的总时长。3创建音色,打开飞言 TTS 安卓客户端。点击个人中心,往下拉,找到我的音色并点击进入。随后并找到创建 Minimax 音色按钮,点击它 ,此时会默认拉起输入框,在这里是让你输入音色名称。第二个输入框是描述音频的风格,可选项可填可不填,第三个输入框是试听音频文案,也是可选项,可填可不填,那怎么上传音频样本呢?往下滑动焦点,你会听到这个提示,上传参考音频 *再往下滑,读屏会念加。就是这里,双击即可打开文件选择页。此时就可以在这里选择你要上传的音频样本了。选择好后,如何判断有没有选择成功呢?同样的还是在上传参考音频 *往下滑,如果成功上传了音频样本,即可听到这个提示,删除以及播放。此时证明你已经选择了该音频样本作为素材了。确认无误就可以点击确认,点击之后,左右滑动,听一下有没有这个提示,创建中按钮已停用。此时不要动,不要锁屏,也不要点取消。等个几秒钟,您会听到这个提示,Minimax 音色创建成功。此时左右滑动一下,在我的音色列表即可看到。你创建的音色。创建好的音色要怎么调用呢?有两种方式可以用。第一种,场景。在语音合成页面输入文本,点击生成语音,即可用你的音色生成音频。注,该音频只有模型朗读的内容,并不是音乐,也不是歌曲,第二种场景,语音库调用。点击语音合成中间的听书标签页,在这个标签页您会听到这个提示。阅读听书音色
阅读 App 朗读时使用的声音。当前:MiniMax · 影视飓风。点"更换"可切换服务和音色点击更换即可进入音色选择页面。此时你会看到一堆音色和服务。豆包、小米、 Minimax 如果你要调用你自己的音色,请选择 Minimax。服务,在音色分类里选择我的音色,即可在音色列表里面看到你创建的音色出现在这个列表里。双击即可选中作为语音库音色进行调用。开源阅读、天坦百宝箱,包括天坦读屏,都可以调用这个音色。注,不建议给读屏软件调用。由于飞言语音库是在线语音库,给读屏软件调用,一旦出现了网络波动或您的账号被系统踢下线。读屏直接变哑巴。避免这样的事故发生。请大家不要轻易的将飞言语音库长期的作为读屏主语音库调用。在网络条件好的情况下调用一下,拿来朗读一下文章。那来看看新闻还是可以的。一旦离开了稳定网络的环境,请切换至内置讯飞语音库或其他本地语音库,避免读屏软件哑巴。
点击这里获取飞言 TTS 客户端。飞言 TTS 用户交流群。664504747
积分:4523
10块钱。
一共10块钱吗?
是的,最低档就是10块钱。几乎是原价,我自己一分不赚。
最高档的你自己看啊,我怕说多了管理员会删帖。
任何人的声音都可以吗?想弄王俊凯。
可以,只要保证音频质量清晰即可。
那要不然用豆包,豆包一个音色要150元。MiniMax 是我能找到最便宜的模型了。其他的要不就是质量不如 MiniMax ,要不就是他们的服务器比较垃圾。而且其他的还有随时跑路的风险,毕竟他们都是自己下载第三方的开源模型,部署到自己的服务器上,对外提供服务的。
法律只管公开传播,你自己私用谁管你啊?你自己拿来听个小说,听个新闻。不要对外炫耀,拿这个王俊凯或者雷军的音色来搞事情。比如说让雷军的音色读粗口啊,读一些不可描述的内容啊,并发到抖音上,人家当然 告你侵权啦!
读那些不好的内容的话,模型应该也会拒绝吧。
模型不会拒绝,毕竟我们用的是它的 API 服务。也就是说,模型厂商只是作为服务提供方。内容审核得由我们开发者来审。
行吧,我再也不敢把我的声音公开出来了。
这个机制就只有大语言模型有,TTS 模型没有。TTS 这边将内容的审核权交给我们开发者。一旦出了问题,厂商也是直接提供证据来证明这个违法内容是第三方开发者调用我们的服务生成的,并不是我们的官方立场。
可以呀。
你喜欢谁的声音?这个我们克隆的声音也可以公开给其他人使用。
安装包就在上面。
但是我们可以随时撤回。
可以。