FunASR 基础语音识别工具包 FunASR是一个基础语音识别工具包,提供多种功能,包括语音识别(ASR)、语音端点检测(VAD)、标点恢复、语言模型、说话人验证、说话人分离和多人对话语音识别等。FunASR提供了便捷的脚本和教程,支持预训练好的模型的推理与微调 1,0010 AI语音识别-音转文# AI开源项目# AI编程
CelestialPDF 适合企业和学生的AI工具 -让AI快速查询想要的资讯,总结以及解释复杂的概念 -支持GPT4-turbo来获得精确的回答 -随意选择多个档案进行问答 -高达250页的免费方案让你可以直接把一学期的书或手册上传到资料库 9410 AI资讯# AI办公# AI办公工具
GPT-SoVITS在线一键语音生成合集(modelscope平台) GPT-SoVITS在线一键语音生成合集(modelscope平台)聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为modelscope.cn。,涉及AI声音克隆、AI语音合成、AI音乐工具适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 1,1510 AI声音克隆# AI声音克隆# AI语音合成# AI音乐工具
GPT-SoVITS 零样本文本到语音(TTS): 输入5秒的声音样本,即刻体验文本到语音转换。 少样本TTS: 仅需1分钟的训练数据即可微调模型,提升声音相似度和真实感。 跨语言支持: 支持与训练数据集不同语言的推理,目前支持英语、日语和中文。 WebUI工具: 集成工具包括声音伴奏分离、自动训练集分割、中文自动语音识别(ASR)和文本标注,协助初学者创建训练数据集和GPT/SoVITS模型。 介绍视频 https://www.bilibili.com/video/BV12g4y1m7Uw/ 来自B站up主:花儿不哭 1,0210 AI声音克隆# AI声音克隆# AI开源项目# AI音乐工具
讯飞同传-实时翻译 讯飞同传-实时翻译聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为tongchuan.iflyrec.com。,涉及AI同传翻译、AI音乐工具适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 7010 AI同传翻译# AI同传翻译# AI音乐工具
PIXGEN高清修复 PIXGEN是一款基于人工智能技术的在线图片处理工具,可以实现一键换脸、背景模糊、抠图、智能美图等功能,使复杂的图片处理变得简单。PIXGEN集成了当前最优秀的深度学习模型,保证图片处理效果,同时提供多种灵活的付费模式,确保不同用户的需求。 需求人群: “PIXGEN可用于日常生活中的各种图片处理需求,如零基础美图、生活照修图、视频截图处理等。” 用PIXGEN快速换掉照片中的人脸 用PIXGEN的抠图功能去掉旅游照片中的游客 一键换脸 背景模糊 抠图 智能美图 9810 AI图像处理# AI无损放大# 图片处理
满分简历 产品功能: 智能点评,精准优化:基于目标岗位,运用智能点评技术,深入挖掘你的优势,让你的简历直达面试邀请的高峰。 智能简历评测:多维度详细分析你的简历,进行全方位的优化,让你在众多求职者中脱颖而出。 挖掘闪光点,匹配适合岗位:深入挖掘你的经历,发现你的潜力,通过算法为你找到最适合的岗位,让你的简历在求职市场上大放异彩。 全领域简历优化:涵盖全行业全职能,从匹配的视角为你优化简历,让你轻松成为“跨界王者”。 产品优势: 专业团队,经验丰富:满分简历的团队由资深人力资源专家和算法工程师组成,对简历制作和求职有着深入的研究和理解,为用户提供最专业的建议和指导。 个性定制,独具特色:根据用户的个人特点和求职需求,提供个性化的简历优化方案,让你的简历更突出、更吸引人。 操作简单,轻松上手:产品界面简洁,操作流程简单,你只需上传简历并选择目标岗位,就能快速获得优化建议和反馈,无需复杂的操作和学习。 显著效果,广受好评:满分简历已经帮助众多用户成功获得了理想的工作机会,用户满意度高达 95%以上。 9510 AI学习网站# AI办公# AI办公工具
OpenXLab浦源的模型中心 OpenXLab浦源的模型中心 支持丰富模型管理方式,模型中心基于模型元信息标准规范,支持用户上传、存储、检索、评测各类模型。基于平台内的命令行工具,便于 AI 开发者上传和发布模型文件,搭建对象存储体系,提供大文件存储能力,快速上传下载功能,便于 AI 开发者进行模型存储。 若您想快速检索您感兴趣的学术预训练模型,您可以通过搜索栏输入模型的名称、任务或者模型相关论文的名称进行预训练模型的检索,若您没有明确的搜索意向,您可以通过标签进行筛选和检索您感兴趣的内容,也可以随意浏览平台热门推荐的模型。 若您对某个模型感兴趣,您可以点击模型卡片,查看模型相关的介绍或直接下载该模型权重进行使用 下载模型权重,您可以点击对应的模型权重的操作栏的“下载”图标,进行模型权重的下载 若您想通过平台提供的SDK方式下载模型权重,也可以直接复制平台提供好的SDK代码,在代码中进行下载,想了解更多 SDK 下载模型权重的方式,可前往 模型中心 Python SDK 文档 若您想通过浦源内容平台的模型中心托管您的预训练模型,您可以创建自己模型仓库进行管理 创建模型入口1:导航栏-创建 创建模型入口2:我的创作- 1,3210 AI文档# AI开发者社区# AI模型库
OpenVoice 翻译站点 其核心功能是通过提供发言者的短音频片段(参考语音),实现声音的高效克隆。 这意味着您可以使用OpenVoice来克隆任何人的声音,而且不限于特定语言。无论您是想要模仿某位名人的声音,还是需要在不同语言之间进行语音转换,OpenVoice都能够满足您的需求。 项目地址: https://github.com/myshell-ai/OpenVoice 9810 AI声音克隆# AI声音克隆# AI开源项目# AI音乐工具
青梧字幕 青梧字幕聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为zimu.qijingdict.com。,涉及AI加字幕/AI字幕翻译、AI视频工具适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 9910 AI字幕翻译# AI加字幕/AI字幕翻译# AI视频工具
IOPaint 翻译站点 IOPaint 是一款免费、开源且完全可自行托管的修复/修复工具,由最先进的 AI 模型提供支持。您可以在 IOPaint 中使用各种模型来更改图像,包括修改、擦除 7910 AI图像处理# AI开源项目# AI编程# 图像擦除
百度AI Studio模型库 包含计算机视觉、自然语言处理、智能语音、文心大模型、科学计算、量子计算等任务方向算法,覆盖智慧金融、智慧安防、智慧工业/能源、智慧城市、智慧交通等多行业场景范例 1,1510 AI大模型# AI开发者社区# AI模型库
UVR5 UVR5聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为uvr5.online。,涉及AI声音分离、AI音乐工具适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 6510 AI声音分离# AI声音分离# AI音乐工具
闪剪 闪剪是一个先进的AI数字人视频生成平台,支持移动端APP版本,平台有丰富的数字人视频模板,用户只需输入关键词,闪剪AI即可自动创作文案一键生成数字人视频。闪剪还可在线定制专属数字人形象及声音,能够1:1复刻用户的形象和声音。闪剪提供200+国际化数字人模特、24+国家AI配音、AI文案创作、智能成片、照片数字人、直播快剪、视频订阅号等功能,让企业团队轻松实现矩阵营销引流,降本增效。 1,3110 AI数字虚拟人# AI 视频创作# 虚拟数字人
CodeWithGPU CodeWithGPU是一个AI镜像、模型技术社区,它以GitHub为基础,在GitHub托管的代码下游,提供额外的镜像环境、算法模型等,解决以往构建环境难、管理与分享模型难的问题,为算法开发者、研究者等提供开箱即用的内容体验。 9210 AI博客论坛# AI开发者社区# AI模型库