视频翻译配音

视频翻译配音

一个免费开源用于编辑和配音视频字幕的工具。用户在生成字幕后,可以轻松地修改它们,并重新生成配音。该工具提供了多种由edgeTTS提供的配音角色,并支持openai的TTS模型配音。此外,它还集成了google、chatGPT、DeepL、Baidu、DeepLX、Gemini和tencent等多种语音识别和翻译工具,以提供全面的服务。除了视频翻译和配音工具,该网站还提供了其他相关的开源项目,如声音克隆工具、语音识别工具和人声背景乐分离工具等。
6110
AnyText

AnyText

AnyText 是一个开源的多语言视觉文本生成和编辑工具,它基于扩散模型,能够在图片中生成或编辑文字。这个工具支持中文、英文、日文和韩文等多种语言,适用于电商海报、Logo 设计、创意涂鸦、表情包等多种场景。AnyText 包含两个核心模块:辅助潜在模块(Auxiliary Latent Module)和文本嵌入模块(Text Embedding Module)。辅助潜在模块负责处理字形、文字位置和掩码图像等辅助信息,而文本嵌入模块则将文字的语义信息与字形信息解耦合,以提高文字生成的精度和背景一致性。在训练阶段,除了使用扩散模型常用的噪声预测损失,还增加了文本感知损失,以提升文字书写的精度。 AnyText 的代码和安装说明可以在其 GitHub 页面上找到。要在本地安装和运行 AnyText,需要至少20GB的内存和高端显卡。安装过程包括克隆代码库、准备字体文件(推荐 Arial Unicode MS),创建新的环境并安装所需的软件包。AnyText 还提供了在线演示,用户可以通过这个演示直接体验其功能。 此外,AnyText 的训练数据集为 AnyWord-3M,主要来源于互联网开
6510
screenshot-to-code

screenshot-to-code

将屏幕截图转换为清洁的HTML / Tailwind / JS代码。 这是一个使用MIT许可证进行许可的项目,因此,它是免费并且开源的。 功能点如下: 1. 屏幕截图转代码:用户通过输入截图,系统将自动将图像转换为HTML,Tailwind,或JS代码。 2. 开源活动:作为GitHub上的公开项目,任何对此项目感兴趣的开发者都可以查看源代码,对其进行修改,或进行贡献。 3. 自动化工作流程:项目包含一系列自动化的功能,可以帮助用户更有效地转换屏幕截图。 这是一个非常实用的工具,对开发者来说,尤其是前端开发者,它可以极大地提高他们的工作效率。
6510
MetaGPT

MetaGPT

MetaGPT 是一个多代理框架,可根据一行要求生成 PRD(产品需求文档)、设计、任务和存储库。 功能特点: 多代理框架:MetaGPT 是一个多代理框架,可以协调多个代理的工作,从而更好地满足需求。 生成多种文档:根据用户的一行要求,MetaGPT 可以生成产品需求文档(PRD)、设计文档、任务列表和存储库等多种文档。 自动化流程:MetaGPT 提供自动化的流程,可以快速生成所需的文档,提高工作效率。 开源许可证:MetaGPT 使用 MIT 开源许可证,使用户可以自由地使用和修改代码。
1,1110
PhotoMaker 翻译站点

PhotoMaker 翻译站点

PhotoMaker,利用多张照片作为身份ID,获取人物特征,然后根据描述生成符合描述的人物照片创造出一个新的、个性化的人物图像。 PhotoMaker也能把几个不同人的照片特征混合在一起,创造出一个全新的人物形象。还能改变照片人物的性别、年龄和生成多种风格的其他照片。快速逼真,效果自然。 PhotoMaker主要功能: PhotoMaker主要特点: PhotoMaker如何工作? PhotoMaker首先分析照片,识别出每张照片中人物的特征,比如面部特征、发型、服装风格等。然后,它将这些特征结合起来,创建一个新的图像。这个图像基本上是你的脸,但可能有着电影明星的发型和表情,同时穿着那张历史服装照片中的服装。 最终的结果是一张全新的照片,这张照片展示了一个独特的人物形象:看起来像你,但具有其他照片中人物的特征和风格。这就是PhotoMaker的核心功能——结合多个不同照片的特征,创造出一个全新、个性化的图像。 源码:https://github.com/TencentARC/PhotoMaker
1,6210
LibreChat 翻译站点

LibreChat 翻译站点

LibreChat,一个增强版的ChatGPT程序,一个免费开源的聊天机器人平台,集成了多种 ai 模型,例如 ChatGPT、OpenAI、BingAI、PaLM 2 等。 LibreChat 允许您与不同的 AI 进行自然且引人入胜的对话,并使用各种功能和插件定制您的体验。LibreChat还集成并增强了原始客户端功能,例如对话和消息搜索、提示模板和插件。 项目地址: https://github.com/danny-avila/LibreChat 官方GitHub:https://librechat.ai 文档: https://docs.librechat.ai
9410
GPT-SoVITS

GPT-SoVITS

零样本文本到语音(TTS): 输入5秒的声音样本,即刻体验文本到语音转换。 少样本TTS: 仅需1分钟的训练数据即可微调模型,提升声音相似度和真实感。 跨语言支持: 支持与训练数据集不同语言的推理,目前支持英语、日语和中文。 WebUI工具: 集成工具包括声音伴奏分离、自动训练集分割、中文自动语音识别(ASR)和文本标注,协助初学者创建训练数据集和GPT/SoVITS模型。 介绍视频 https://www.bilibili.com/video/BV12g4y1m7Uw/ 来自B站up主:花儿不哭
8410