ChatGLM2-Voice-Cloning

3周前发布 921 0 0

声音克隆和对话交互。它允许用户与喜欢的角色进行沉浸式对话,通过使用ChatGLM2模型和SadTalker模型来生成对话内容,并结合声音克隆技术实现角色的真实声音

语言:
zh
收录时间:
2026-08-31
ChatGLM2-Voice-CloningChatGLM2-Voice-Cloning

ChatGLM2-Voice-Cloning主要用于进行声音克隆和对话交互。它允许用户与喜欢的角色进行沉浸式对话,通过使用ChatGLM2模型和SadTalker模型来生成对话内容,并结合声音克隆技术实现角色的真实声音。

数据统计

相关导航

StirlingPDF

StirlingPDF

一个本地的PDF处理工具,其界面为Web UI,支持Docker部署。这个基于网络的本地应用最初完全由ChatGPT创建,之后经过发展,增加了更多功能,满足用户在PDF处理上的多样化需求。 这个工具能够处理各种主要的PDF操作,例如拆分、合并、转换格式、重新排列、添加图片、旋转、压缩等。 此外,Stirling PDF在处理过程中不会对外发送任何数据以进行记录或跟踪。所有的文件和PDF要么只在客户端处理,要么只在服务器内存中暂存,用于执行任务,或者仅在执行任务时保存在临时文件中。一旦用户下载了文件,那些文件就会从服务器上删除。 以下是该工具的一些特性: * 支持深色模式。 * 可自定义的下载选项。 * 文件的并行处理和下载功能。 * 提供API,可与外部脚本整合。 * 可选的登录和认证功能。 以下是该工具的PDF功能: * 页面操作:查看和修改PDF,支持添加注释、绘图、文本和图片;提供完整的交互式界面,用于合并、拆分、旋转、移动PDF及其页面;将多个PDF合并成一个文件;在指定页码处拆分PDF或将所有页面作为单独文件提取;按不同顺序重新排列PDF页面;以90度的增量旋转PDF;删除页
Data-Science-For-Beginners

Data-Science-For-Beginners

由微软开发的一个开源项目,旨在向初学者介绍数据科学的基本知识和技能。该项目包括10个周的学习内容,共分为20个课时。它提供了一个逐步学习的路径,让学习者能够系统地学习数据科学的各个方面。 Data-Science-For-Beginners项目的主要功能点包括以下几个方面: 学习内容:项目提供了一系列丰富的学习内容,涵盖了数据科学的各个核心领域,包括数据收集、数据清洗、数据分析、机器学习等等。通过这些学习内容,初学者可以逐步掌握数据科学的基本概念、方法和工具。 学习路径:项目提供了一个逐步学习的路径,帮助初学者有条不紊地学习数据科学。学习路径按照逻辑顺序组织,从最基础的概念开始,逐步深入。每个课时都提供了详细的学习指导和实践项目,让学习者能够动手实践和巩固所学知识。 开源资源:该项目是一个开源项目,所有的学习材料和代码都可以在GitHub上找到。这意味着任何人都可以自由访问和使用这些资源,并参与到项目的开发和改进中。 全面覆盖:Data-Science-For-Beginners项目涵盖了数据科学的各个领域和技术,包括Python编程语言、数据可视化、统计学基础、机器学习算法等。学习者
Wunjo

Wunjo

一个高级语音和Deepfake神经网络工具。功能: * 可以合成和克隆英语、俄语和中文的声音,同时支持实时语音识别。 * 能深度伪造面部和嘴唇动画,并使用一张照片进行人脸交换。 * 通过文本提示改变视频,进行分割和修饰。 * 具有语音合成、声音克隆、实时语音识别、多对话创建、视频到视频转换、深度伪造动画、AI修饰工具、自动分割掩码等功能。 * 支持英语、俄语、中文和西班牙语等多种语言。 * 适用于初学者和专业人士。 * 保护用户隐私。 * 应用于广告配音、游戏角色配音、有声书朗读和深度伪造项目等应用场景。 * 需要Python 3.10和ffmpeg作为运行环境。 * 由Wladislav Radchenko进行开发和维护。
GPT-SoVITS

GPT-SoVITS

零样本文本到语音(TTS): 输入5秒的声音样本,即刻体验文本到语音转换。 少样本TTS: 仅需1分钟的训练数据即可微调模型,提升声音相似度和真实感。 跨语言支持: 支持与训练数据集不同语言的推理,目前支持英语、日语和中文。 WebUI工具: 集成工具包括声音伴奏分离、自动训练集分割、中文自动语音识别(ASR)和文本标注,协助初学者创建训练数据集和GPT/SoVITS模型。 介绍视频 https://www.bilibili.com/video/BV12g4y1m7Uw/ 来自B站up主:花儿不哭