优云智算
控制台
立即注册

VoxCPM2 ONNX版本

VoxCPM2 ONNX加速版

镜像大小
60 GB
当前版本
v1.0
累计部署
40
累计运行
12 h
最近更新
2026-07-15

运行环境

框架版本
PyTorch-2.8.0
CUDA版本
128
应用
JupyterLab: 8888
支持卡型
RTX40系RTX50系
+7

镜像名称

VoxCPM2 ONNX版

镜像简介

主要用于语音合成,基于VoxCPM2的ONNX版本生成。
相比于PyTorch版本的VoxCPM2,性能有所提升,使用4090显卡测试的 RTF约在0.3左右。
换算成字数的话,千字大约40多秒, 当然这个数据取决于具体的测试方法,这里只做了简易测试,测试文件参考: https://wcnn68ei31q6.feishu.cn/wiki/HEAJwPFloiYEk9k89rtc5O7Bnhb

使用教程

支持可控克隆、极致克隆、音色设计、查看文本切分、从视频中提取音频、查看音频元数据等操作,页面如下: 由于功能都比较简单,所以不再介绍其用法。 image.png

帮助文档:

更多更及时的信息请 参考: https://wcnn68ei31q6.feishu.cn/wiki/HEAJwPFloiYEk9k89rtc5O7Bnhb

环境验证代码

支持自启动,在 /worksapce目录中的 日志文件log.txt中看到 Running on http://0.0.0.0:7860 说明启动成功了。

常见问题

Q1: 生成的音频如果没有及时下载,还能获取吗?

A1: 可以,在/worksapece的 outputs目录中下载即可。

0 个镜像 · 被使用 40
交流与支持
交流群二维码
扫码加入交流群
作者与用户在群内答疑
版本日志
v1.0最新
2026-07-02
首次实现对ONNX的支持
评分
0.0
暂无评分
我的评分
未评分