浅谈一下豆包音频生成模型上线到豆包 App之后的使用感受。

5 乐见 2小时前 96次点击

大家好,之前其实已经有细心的贴友在这里发帖。咱们的豆包音频生成模型,已经正式上线到豆包app了哈。

今天我特地去支付了一元,开通了那个7天的豆包标准套餐。然后就迫不及待的去使用了他的音频生成。

总体来说,在app内使用这个模型给我的体验还是非常不错的。首先给我的最大感受就是他这个上下连贯性非常好。什么是连贯性呢,就是拿一段很长很长的文本,要把它制作成音频,在网页端你需要把它拆分成一小段一小段的发给他,因为他的最大时长只有两分钟, 但在豆包里就可以一整段的复制给他然后要求豆包给你拆分成多个片段进行制作。可以说是补齐了之前在网页端使用的一个巨大痛点了。

然后第2个。在豆包里使用文本制作音频,不需要太注重提示词。假设我现在有一个很长的小说文本要制作成音频,直接扔给豆包。提要求,需要制作成什么样的。比如全程环境渲染和背景音乐在线,人物特征鲜明。类似的这样写了之后,一般出来的效果还是非常可以的。角色基本上可以保证不崩。使用过网页的铁友可能深有体会,网页是非常注重提示词的,提示词没有写好的话,音频里面的角色人设直接就崩了。

Ok, 最后我们来说一说我非常非常想分享给大家的究极重磅内容。

在豆包里面制作音频,没有时长限制了,想要多长就有多长。其实在豆包里面制作音频,在我看来,根本没有那个所谓的两分钟时长限制。因为豆包你是可以跟他交流,跟他沟通的。你扔一个长文本给他,让他制作多个音频之后,把这制作的所有文件直接让他给你拼接成一个音频,这样就实现了长音频的制作。他执行的逻辑就是先给你生成一堆的两分钟音频小片段。然后他自己调用工具,把这些音频整合拼接到一起,就变成一个长音频了。如果觉得音频的拼接处会割裂、不协调。就让他在拼接的地方加上过渡音效就可以了。可以说是非常的 nice了。

以上就是我给大家总结的豆包音频生成的体会和心得了。总而言之,在豆包制作音频,用两个字概括,那就是灵活。想要什么要求直接给他提。网页端用这个模型制作,给他提要求,似乎他就听不懂,可能是写的提示词不够专业。在豆包的话,我猜想豆包的执行逻辑应该是分成了好几个板块。首先,他应该是把我们的需求润色和整理了一下,然后梳理了我们的要求之后调用了音频生成模型,负责和我们交互的这个模型应该不直接参与制作。然后音频生成模型制作好了就有和我们交互的这个模型,把内容输出给我们,应该就是这个逻辑了。不然的话,我猜想应该还会出现和网页端一模一样的情况。通俗来讲,就是音频生成模型,好像有点听不懂人话。然后豆包这个公司领导把我们的指令再次下发给他。他才能明白用户的需求。

Ok,ok,楼主的巴拉巴拉,这下子真的是已经说完了。下面给大家上传一段用豆包制作的音频。大家品鉴品鉴,看一看成品效果怎么样。 Ok, 来,交作业。

使用qq生成链接,点此下载。

温馨提示一下。第一,由于这个文件超过50兆,没办法直接上传音频上来。所以我只能生成一个链接,需要大家下载到本地才可以听。如果没办法下载,请大家在下面告知。第二,为了凸显豆包生成长音频的能力,我让他制作了一个很长很长很长的音频,音频长度2.5小时,大家适当收听,哈哈。第三,这个音频是由豆包全权自由发挥制作而成,音频里面的剧情内容没有给他提供任何方向。不能说剧情很烂,简直是差到极点了,大家听个响就行,嘿嘿。不用去挖掘剧情内容。否则会出现一堆逻辑报错。第四,由于本音频全全ai制作而成,剧情无聊。且时间够长。这边建议直接躺着看,说不定还能起到助眠的效果。

共 14 条评论
微风细雨 1小时前
0 
资源读取错误。
乐见 [楼主] 2小时前
0 

楼主的技术太落后了,哈哈,感谢感谢。

小星星 2小时前
0 
楼主啊,其实豆包音频生成刚上线之后,我就迫不及待让他用他的配音资源调用做了一款关于包青天的游戏。里面的背景音乐啊,配乐啊,包括那个剧情啊,全程都是用豆包音频生成完成的,所以平常你闲着无聊也可以用它来做一款。呃,自己想象中的那种有角色的游戏以及战斗游戏也可以的哈。
乐见 [楼主] 1小时前
0 

嗯,我看了你上午发的帖子,你那个游戏非常不错。我试过让豆包写游戏,但是不知道是不是我话术的问题,随着他游戏的代码量增多了之后,会出现各种各样的bug。关键是让他修吧,他还修不好。本来我上次都做好了一个代码量1万多行的小游戏准备发到社区上玩一玩,但是发现bug太多了,就放弃了。

小星星 1小时前
0 
这个好吧,有时候你要把自己写游戏的思路要想好的,想好之后呢,你先发给豆包,让豆包转换成办公任务的规格,然后你把这个办公任务的规格复制下来,然后再去深度思考。打开办公任务模式,然后你就把豆包原先说的那个呃办公任务的规格发给他,然后马上就帮你创作游戏了,等我哪一天有时间的话,我就发个教程上来给你们看一下,只不过你们别嫌那个文字很长就行了。
澜渊星辰 1小时前
0 

哈哈,我也这么干过,我这里有两部手机,第1部手机是新版本豆包,第2部手机是旧版本豆包。还挺好玩,不过这个音频生成我很少用,因为我平时想象力不怎么丰富,还是结给我们那个同学弄。

微风细雨 1小时前
0 
那这样还好,这个钱花的值得了。
九霄云外 1小时前
0 
这两天也在玩,整体来看还是不错的,但是还是有优化空间的。
乐见 [楼主] 35分钟前
0 

优化的空间还大着呢,我那个剧情里面其实很多角色的声音,尤其是到了后期,根本不协调。而且还串台。

0 

哎呀,楼主这个体验分享写得很详细啊。关于那个豆包帮你润色指令再下发给音频模型的猜测,我觉得挺有道理的。现在好多AI产品都在做这种中间层,就是怕用户不会写提示词导致效果不好,所以加一层理解转换。网页端直接给模型发原始指令,模型听不懂就崩了,app端有个中间层帮忙翻译整理,效果自然好很多。那个长音频拼接的思路确实聪明,让AI自己拆分再拼接加过渡音效,等于把人工的活都交给AI干了。不过2.5小时的纯AI剧情音频,楼主也是够有耐心的哈哈,听起来当助眠确实挺合适。话说豆包这个音频生成模型,跟之前网页端用的应该是同一个底座吧?如果app端效果明显更好的话,可能不仅仅是中间层润色的问题,说不定调用的参数也不一样。一块钱七天体验还是很划算的,回头我也去试试。

乐见 [楼主] 36分钟前
0 

其实也没有了。让豆包制作这么长的东西我唯一需要做的就是等待。像我这么懒,根本不会给豆包发那么复杂的指令。直接让他生成一个2.5小时的短剧。生成完了也不会去检查,简单听一下就发上来了。

凡尘谪仙 23分钟前
0 

他那7天试用的一元有没有限制生成次数

乐见 [楼主] 4分钟前
0 

他不是以生成次数来判断你的使用量。他是看你消耗了多少算力,也就是多少额度。一般这个额度每天给你的量还是很多的。不过需要注意的是,如果你你长时间高频使用的话,可能会有冷却时间。但是并不长,一般是几十分钟到几小时左右。不用太担心额度消耗,至少上面我那个2.5小时的音频都还没有用完的额度。

添加一条新评论

登录后可以发表评论 去登录