-
Stable Audio 2.5 企业级音频生成 AI 模型发布,号称“3 分钟曲目 2 秒钟完成”
9 月 14 日消息,Stability AI 现已正式发布企业级音频生成模型 Stable Audio 2.5,相对上一代主要围绕音频细节、生成速度方面进行提升,号称“仅需 2 秒钟即可创建 3 分钟音频曲目”。 据介绍,Stable Audio 2.5 的核心改进集中在音乐生成能力方面,号称生成结果更加贴合实际编曲逻辑,可呈现前奏、发展与结尾等完整多段式结构。同时新模型对提示词的理解更为准确,…- 5.1k
-
阿里通义开源旗下首个音频生成模型 ThinkSound:可像“专业音效师”一样思考
7 月 4 日消息,阿里“通义大模型”公众号今日发文宣布,通义实验室首个音频生成模型 ThinkSound 现已正式开源,将打破“静音画面”的想象力局限。 ThinkSound 首次将 CoT(Chain-of-Thought,思维链)应用到音频生成领域,让 AI 学会一步步“想清楚”画面事件与声音之间的关系,从而实现高保真、强同步的空间音频生成 —— 不只是“看图配音”,而是真正“听懂画面”。 …- 41.9k
-
Stability AI开源音频生成模型Stable Audio Open,可生成47秒的立体声音频
最近,Stability AI 团队推出了一款全新的开源音频生成模型,名为 Stable Audio Open。这款模型的特别之处在于,它能够从文本提示生成时长可达47秒的立体声音频,采样率高达44.1kHz。 与许多当前流行的音频生成模型不同,Stable Audio Open 的权重是开放的,这意味着任何人都可以查看、修改和扩展这个模型。这样的设计理念不仅推动了科学研究的进展,也为开发者提供了…- 4.7k
❯
搜索
扫码打开当前页
返回顶部
幸运之星即将降临……
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠
-
¥優惠使用時效:无法使用使用時效:
之前
使用時效:预期有效优惠编号:×
没有优惠可用!


