音频版ControlNet!Adobe发声音模仿新方法Sketch2Sound

Sketch2Sound通过提取音量、亮度和音高等控制信号,将声音模仿转换为新声音生成,基于DiT模型实现,微调步骤少,模型轻量化;采用随机中值滤波,允许灵活时间精度的控制信号提示,声音艺术家可在“草图感”和“精确度”之间选择;模型智能化生成声音,结合文本提示和声音手势,能在不同场景下自动调整生成结果。

搜索