Gorden Sun推文
BreezeBlue开源Breeze-TTS-2
BreezeBlue由前MiniMax技术合伙人杨斌创立,专注于实时语音交互大模型与音频AI。其开源的Breeze-TTS-2支持中英双语,具备声音克隆、声音设计、情绪语速控制及语气词表现等领先音频能力。
译文
BreezeBlue开源Breeze-TTS-2 BreezeBlue由前MiniMax技术合伙人杨斌创立,专注于实时语音交互大模型与音频AI。 Breeze-TTS-2支持中英双语,效果很不错,市面领先的音频能力都有,包括: 克隆声音:你只要给它一段清晰的真人录音和对应的文字稿,它就能模仿这个人的音色和说话语气来读新的内容。 设计声音:不需要提供现成的录音,直接用大白话描述,比如“一个声音温暖、语气平静的年轻女生”,它就能自己捏出一个符合描述的全新声音。 指挥情绪和语速:在模仿某个声音时,你可以给它下指令,让它说话慢一点、严肃一点或者更热情一些。 自带语气副词和小动作:在文字里加上括号写上笑声、叹气或者清嗓子,它在读到的时候就会真的把这些声音表现出来。 模型:https://huggingface.co/BreezeBlue/Breeze-TTS-2
BreezeBlue开源Breeze-TTS-2 BreezeBlue由前MiniMax技术合伙人杨斌创立,专注于实时语音交互大模型与音频AI。 Breeze-TTS-2支持中英双语,效果很不错,市面领先的音频能力都有,包括: 克隆声音:你只要给它一段清晰的真人录音和对应的文字稿,它就能模仿这个人的音色和说话语气来读新的内容。 设计声音:不需要提供现成的录音,直接用大白话描述,比如“一个声音温暖、语气平静的年轻女生”,它就能自己捏出一个符合描述的全新声音。 指挥情绪和语速:在模仿某个声音时,你可以给它下指令,让它说话慢一点、严肃一点或者更热情一些。 自带语气副词和小动作:在文字里加上括号写上笑声、叹气或者清嗓子,它在读到的时候就会真的把这些声音表现出来。 模型:https://huggingface.co/BreezeBlue/Breeze-TTS-2