面壁智能 VoxCPM 1.5 语音生成 AI 模型开源：高采样音频克隆，生成效率翻倍

资讯
25年12月11日
編輯

admin

12 月 11 日消息，面壁智能官宣，VoxCPM 1.5 版本正式上线，在持续优化开发者开发体验的同时，也带来了多项核心能力升级。

VoxCPM 是一个 0.5B 参数尺寸的语音生成基座模型，于今年 9 月首次发布。

面壁智能 VoxCPM 1.5 语音生成 AI 模型开源：高采样音频克隆，生成效率翻倍

1AI附 VoxCPM 1.5 更新亮点：

高采样音频克隆：AudioVAE 采样率从 16kHz 提升至 44.1kHz，模型可根据高质量音频，克隆效果更佳、细节更丰富的声音；
生成效率翻倍：在模型参数有所增加的前提下，VoxCPM 1.5 仅需 6.25 个 token 即可生成 1 秒音频，较此前版本提高一倍，在保持速度的同时提升了音频生成质量；
开发者友好：新增 LoRA 和全量微调脚本，支持深度定制；
增强稳定性：减少音频伪影，优化长文本音频的生成效果。

目前，VoxCPM 1.5 模型已在 Github、Hugging Face 开源。

Huggingface：https://huggingface.co/openbmb/VoxCPM1.5
Github：https://github.com/OpenBMB/VoxCPM

声明：内容来源公开的各类媒体平台，若收录的内容侵犯了您的权益，请联系邮箱，本站将第一时间处理。

开源语音生成面壁智能

AI 智能体开源基金会成立，OpenAI、谷歌、亚马逊 AWS 等巨头加入

2025-12-11 16:04:04

谷歌：Gemini 目前没有广告，公司也没有改变现状的计划

2025-12-11 16:07:29

❯

搜索

幸运之星即将降临……

点击领取今天的签到奖励！

恭喜！您今天获得了{{mission.data.mission.credit}}积分

今日签到

连续签到

{{item.credit}}

连续{{item.count}}天

查看所有

我的优惠

_￥_優惠

使用時效：无法使用

使用時效：
之前

使用時效：预期有效

优惠编号：
×

限制以下商品使用：限制以下商品分类用途：不限制使用：

[{{ct.name}}]

所有商品及商品类型需求使用

没有优惠可用！

购物车

×

德

空空如也！

清空貨櫃前往

您的有新私信

没有新私信

写新私信查看全部