RVC;Retrieval-based-Voice-Conversion-WebUI

3周前发布 1,131 0 0

一个基于VITS的简单易用的语音转换(变声器)框架,开源变声模型【RVC】 下面是其中的一个人声与AI人声的合作案例 这是up主和自己的AI歌声合唱的视频,其中用到了变声使用框架:RVC和DiffSinger开源项目 标题:中日双语花海!我和自己的ai合唱了! 链接: https://www.bilibili.com/video/BV1Q...

语言:
zh
收录时间:
2026-08-31
RVC;Retrieval-based-Voice-Conversion-WebUIRVC;Retrieval-based-Voice-Conversion-WebUI

一个基于VITS的简单易用的语音转换(变声器)框架,开源变声模型【RVC】 下面是其中的一个人声与AI人声的合作案例 这是up主和自己的AI歌声合唱的视频,其中用到了变声使用框架:RVC和DiffSinger开源项目 标题:中日双语花海!我和自己的ai合唱了! 链接: https://www.bilibili.com/video/BV1QP411X7A6/  下面这是AI的声音协力、视频制作的up主在评论区所分享的技术要点: 介于旧版未能展示笔记全文,把笔记要点整理如下 1 由九三本人授权素材, @花儿不哭 使用开源变声模型【RVC】训练AI声库模型并等待后续推理。 2 使用开源歌声合成引擎【DiffSinger】模仿九三唱法进行虚拟歌姬调教作为输入源。 a. 获取 東北きりたん 歌唱データベース同意利用规约获取开源数据并训练 b 利用Synthesizer V 制谱(1.9及以后需要冻结实参),感谢 @某只泽 老师的原始谱面,我加了一些自己对93、周杰伦、中孝介对花海演绎的理解。 c 使用OpenSVIP工程转换后得到USTX工程,使用OpenUTAU调教:对特色转音、咬字进行最终调整。第一次调日文,比较生疏。 d 作为输入源使用RVC进行换声推理,并进行后续混音。 在此感谢九三小姐姐的演唱、花儿不哭大佬的RVC模型训练,以及在幕后辛勤工作的DiffSinger全体开发者、日语数据集标注者、模型训练者,在合规的情况下为大家展示AI的可能性。最后,DiffSinger是一款开源歌声合成SVS工具,在有本人授权和充足时间和标注的情况下,可以先制作AI声库,再直接用midi和歌词进行翻唱,继续改善细微的跨语种口音差异,以及拓展词曲创作赋能虚拟歌姬的上限。关注AI的同学们可以在了解简单易用的几种变声器工具的同时,关注不断在发展的DiffSinger项目。 b站视频教程 【RVC】全新Al变声器一键训练包发布!10分钟克隆你的声音!_哔哩哔哩_bilibili

数据统计

相关导航

clone-voice

clone-voice

这是一个声音克隆工具,可使用任何人类音色,将一段文字合成为使用该音色说话的声音,或者将一个声音使用该音色转换为另一个声音。 使用非常简单,没有N卡GPU也可以使用,下载预编译版本,双击 app.exe 打开一个web界面,鼠标点点就能用。 支持 中、英、日、韩、法、德、意等16种语言,可在线从麦克风录制声音。 为保证合成效果,建议录制时长5秒到20秒,发音清晰准确,不要存在背景噪声。 英文效果很棒,中文效果还凑合。
Wunjo

Wunjo

一个高级语音和Deepfake神经网络工具。功能: * 可以合成和克隆英语、俄语和中文的声音,同时支持实时语音识别。 * 能深度伪造面部和嘴唇动画,并使用一张照片进行人脸交换。 * 通过文本提示改变视频,进行分割和修饰。 * 具有语音合成、声音克隆、实时语音识别、多对话创建、视频到视频转换、深度伪造动画、AI修饰工具、自动分割掩码等功能。 * 支持英语、俄语、中文和西班牙语等多种语言。 * 适用于初学者和专业人士。 * 保护用户隐私。 * 应用于广告配音、游戏角色配音、有声书朗读和深度伪造项目等应用场景。 * 需要Python 3.10和ffmpeg作为运行环境。 * 由Wladislav Radchenko进行开发和维护。
大饼AI变声

大饼AI变声

大饼AI变声(Dubbing.tech)是一款功能强大、免费专业的实时语音变声软件,是国内首款基于AI深度学习的声音引擎,并且支持全场景切入,兼容和支持多种游戏以及语音客户端。大饼AI变声的音色丰富,有数百种音色可供选择,每期提供免费的变声音色。除了实时变声,大饼声音引擎SaaS版还提供了文字转语音、声音克隆、声音定制、声音转换等功能,全方位地满足对多元声音的需求。
GPT-SoVITS

GPT-SoVITS

零样本文本到语音(TTS): 输入5秒的声音样本,即刻体验文本到语音转换。 少样本TTS: 仅需1分钟的训练数据即可微调模型,提升声音相似度和真实感。 跨语言支持: 支持与训练数据集不同语言的推理,目前支持英语、日语和中文。 WebUI工具: 集成工具包括声音伴奏分离、自动训练集分割、中文自动语音识别(ASR)和文本标注,协助初学者创建训练数据集和GPT/SoVITS模型。 介绍视频 https://www.bilibili.com/video/BV12g4y1m7Uw/ 来自B站up主:花儿不哭
TexttoSpeech.im:免费在线将文本转换为语音

TexttoSpeech.im:免费在线将文本转换为语音

TextToSpeech.im介绍 —— 终极文本转语音解决方案 ?无缝转换文本为语音:享受TextToSpeech.im先进的神经网络技术!我们迅速将您的文本转换为高质量的语音体验。 ? 50种语言支持,8000种音色:无论您是为全球受众创建内容还是针对特定的地域口音,我们准备为您提供服务。我们支持50多种语言和将近8000种独特的音调。 ? 完全免费,无需注册:我们的服务完全免费。您不需要注册或使用任何其他隐藏费用。TextToSpeech.im向所有人开放! ⚡快速语音合成:我们利用先进并强大的神经网络推理模型为您提供快速的文本到语音转换服务,为您节省时间! ?商用免费:所有合成的音频文件都是100%您的版权,可用于任何合法用途。 您的音频内容生产方式将彻底改变! 加入我们的社区,使用TextToSpeech.im!