FunASR 基础语音识别工具包 FunASR是一个基础语音识别工具包,提供多种功能,包括语音识别(ASR)、语音端点检测(VAD)、标点恢复、语言模型、说话人验证、说话人分离和多人对话语音识别等。FunASR提供了便捷的脚本和教程,支持预训练好的模型的推理与微调 8810 AI语音识别-音转文# AI开源项目# AI编程
讯飞译制 讯飞译制是一款基于科大讯飞语音识别技术的AI视频字幕制作软件,提供视频加字幕,自动添加字幕,视频翻译,字幕时间码匹配等功能的自动生成字幕软件,支持生成SRT/ASS/XML等格式,支持导出成品。 8710 AI语音识别-音转文
音剪 音剪聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为audioeditor.ximalaya.com。适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 8710 AI语音识别-音转文
Insanely Fast Whisper 一个使用OpenAI的Whisper Large v2进行语音识别的脚本,能够在短短10分钟内转录300分钟的音频 。该项目的目标是提供一个简单的入口来运行推理和微调Whisper,用于自动语音识别(ASR) 。该项目还提供了一个CLI(命令行界面),可以在终端上进行100多种语言的数据翻译和转录 。 8310 AI语音识别-音转文# AI开源项目# AI编程
33字幕 AI字幕工具,支持英语、日语、韩语、法语、西班牙语、意大利语、葡萄牙语、德语、中文等20多种不同国家语言,ChatGPT生成台词摘要,给视频自动加字幕,高精度AI语音转写模型,语音识别字幕,支持SRT和ASS格式字幕。 8310 AI语音识别-音转文# AI加字幕/AI字幕翻译# AI视频工具
小爱开放平台 小爱开放平台聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为developers.xiaoai.mi.com。,涉及AI 编程开发、开放平台适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 7710 AI语音识别-音转文# AI 编程开发# 开放平台
场辞 场辞(https://trans.xinpianchang.com/): AI智能高效的视频字幕制作利器 场辞是新片场官方推出的一款功能强大的 AI 视频字幕制作软件。它采用了行业头部视频制作团队的工作流,集成先进的语音识别技术,为各种类型的视频内容提供全面且精准的字幕解决方案。 其主要特点 7510 AI语音识别-音转文# 视频工具
SenseAudio SenseAudio支持AI配音、高精度AI语音识别、克隆音色、文生音色、商汤输入法SoWork、声音定制等服务,提供真人感TTS音色。适用于播客、有声书、办公学习等多场景。 7510 AI语音识别-音转文
AI gpt中转站支持GPT-4、Claude3 当前支持的模型: ✅GPT-3.5 所有版本以及 Embedding 官方接口:支持最新 gpt-3.5-turbo-0125、text-embedding-3-large、text-embedding-3-small 模型。 ✅GPT-4 所有版本官方接口:支持最新 gpt-4-0125-preview、gpt-4-turbo-preview、gpt-4-1106-preview、gpt-4-vision-preview 等模型 ✅GPT-4-32K 所有版本官方接口(32K 系列为老模型,价格贵)。 ✅OpenAI 文本转语音模型:tts-1、tts-1-1106、tts-1-hd、tts-1-hd-1106 ✅OpenAI 语音转文本模型:whisper-1 ✅OpenAI embedding 模型:text-embedding-ada-002、text-embedding-3-small、text-embedding-3-large(官网原价渠道,实际价格及倍率对标原价) ✅Claude3 模型:claude-2、claude-3-opus-20240229、claude-3- 7410 AI语音识别-音转文# AI应用接口API# AI编程
Veed AI Voice Generator Veed AI Voice Generator聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为veed.io。,涉及文本转语音、语音生成、语音转文本适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 7120 AI语音识别-音转文# 文本转语音# 语音生成# 语音转文本
ModelArts ModelArts是华为推出的面向开发者的一站式AI平台,可快速创建和部署模型,管理全周期AI工作流。ModelArts为机器学习与深度学习提供海量数据预处理及交互式智能标注、大规模分布式训练、自动化模型生成,及端-边-云模型按需部署能力,帮助用户快速创建和部署模型。ModelArts适用于图像分类、物体检测、视频分析、语音识别、产品推荐和异常检测等多种AI应用场景,并且支持开发者在AI市场中分享和获取模型。 6910 AI语音识别-音转文# AI 编程开发# 应用开发# 开放平台
duiopen duiopen聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为duiopen.com。,涉及AI应用接口API、AI编程适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 6710 AI语音识别-音转文# AI应用接口API# AI编程
牛牛面试 牛牛面试聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为offernn.com。适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 6710 AI语音识别-音转文
FineVoice AI Audio Generator FineVoice is an AI voice generator and video voiceover platform to create realistic text-to-speech, voiceovers, music, and sound effects for videos. Produce studio-quality audio in seconds. 6610 AI语音识别-音转文
听脑AI 听脑AI聚焦面向人工智能创作与应用的在线工具,适合创作者、开发者和需要提升效率的用户使用。,官网域名为itingnao.com。,涉及视频音频适合需要相关工具与资源的个人用户、创作者或团队使用,可从官网了解最新功能、使用方式和服务条款。 6510 AI语音识别-音转文# 视频音频