Stable Audio 2.5 企业级音频生成 AI 模型发布，号称“3 分钟曲目 2 秒钟完成”

资讯
25年9月15日
編輯

admin

9 月 14 日消息，Stability AI 现已正式发布企业级音频生成模型 Stable Audio 2.5，相对上一代主要围绕音频细节、生成速度方面进行提升，号称“仅需 2 秒钟即可创建 3 分钟音频曲目”。

据介绍，Stable Audio 2.5 的核心改进集中在音乐生成能力方面，号称生成结果更加贴合实际编曲逻辑，可呈现前奏、发展与结尾等完整多段式结构。同时新模型对提示词的理解更为准确，尤其在情绪描述和音乐风格词汇的把握上，响应更符合预期。

此外，新版模型还显著改进了音频生成速度，Stability AI 称这主要得益于研发团队提出的后训练方法 ARC（注：Adversarial Relativistic-Contrastive），这一技术通过结合相对式对抗训练与对比判别器，加速扩散模型的生成过程，可在保证音轨质量的同时显著降低 GPU 推理耗时，从而实现 2 秒钟生成长达 3 分钟的音频内容。

除此之外，Stable Audio 2.5 还新增了音频修补能力，用户可以导入自己的音频文件，并指定“延展位置”，模型即可根据音频前后内容及整体曲风，将音频一键“延长”，特别适合剪辑等场景。

目前，Stable Audio 2.5 已可通过 StableAudio 官网直接试用，同时支持本地化部署。不过官方规定，用户上传的音频文件不得包含受版权保护的内容，StableAudio 网站将利用自带的内容识别系统进行检测，以确保不侵犯他人版权。

声明：内容来源公开的各类媒体平台，若收录的内容侵犯了您的权益，请联系邮箱，本站将第一时间处理。

{{userData.name}}已认证

Stable Audio 2.5 企业级音频生成 AI 模型发布，号称“3 分钟曲目 2 秒钟完成”

研究发现：主流 AI聊天机器人传播虚假信息的概率较去年翻倍

马斯克的 xAI 推出 Grok 4 Fast：响应速度最高达标准版 10 倍

AI微博

AI应用

5000+AI应用！每日更新

1AICLUB

强烈推荐！官方品牌微博

AI教程

海量教程看不完

AI基础训练营

零基础入门，带你成为AI高手

1ai抖音

1ai大神

抖音号：1ai.net

1ai大神

抖音号：1ai.net

1ai微信

每天五分钟

一年变大神

扫码关注

{{userData.name}}已认证

相关内容：

研究发现：主流 AI聊天机器人传播虚假信息的概率较去年翻倍

马斯克的 xAI 推出 Grok 4 Fast：响应速度最高达标准版 10 倍

Stability AI开源音频生成模型Stable Audio Open，可生成47秒的立体声音频

Stability AI 推出新一代文生图模型 Stable Cascade，号称比 SDXL 更高效更强悍

文生图 AI 巨头 Stability AI 被曝欠下近 1 亿美元，正与投资者洽谈融资事宜

Stability AI开源SD 3：6月12日可下载 不可商用

AI应用

5000+AI应用！每日更新

1AICLUB

强烈推荐！官方品牌微博

AI教程

海量教程看不完

AI基础训练营

零基础入门，带你成为AI高手

1ai大神

抖音号：1ai.net

1ai大神

抖音号：1ai.net

每天五分钟

一年变大神

扫码关注

Stability AI开源SD 3：6月12日可下载不可商用