声音模型的 Seedance 时刻,终于来了
今天我体验到一个全新的声音模型,跟以前所有的声音模型都不一样。
以前的声音模型一般叫 TTS(文本转语音),它们只能根据你给的文本来合成语音,它更像是一个朗读机器,而非智能声音模型。
但这个新模型,可以根据你的想象,生成一切你所需要的声音,包括人声、音乐、音效、环境音,以及这些声音里所富含的那些不可言说的微妙细节。
它的名字名字叫:豆包音频生成模型 Seed Audio 1.0。
在我看来,这就是声音模型的 Seedance 时刻。
就像香蕉是人类第一次将智能赋予图像,Seed Audio 是人类第一次将智能赋予声音。
接下来,就让我们一起听听它到底有何特别。
即刻不能发音频,可转至公众号来听
我们去年做 ListenHub 的时候,最想要的就是这样一个模型,可以把用声音智能创造有趣且有用的内容。
等了这么久,终于来了。
接下来我们会把 Seed Audio 接入 ListenHub ,到时候大家在制作音频内容的时候,一定会有全新的体验。
大家可以关注官网 listenhub.ai 很快上线