CodeWithGPU CodeWithGPU是一个AI镜像、模型技术社区,它以GitHub为基础,在GitHub托管的代码下游,提供额外的镜像环境、算法模型等,解决以往构建环境难、管理与分享模型难的问题,为算法开发者、研究者等提供开箱即用的内容体验。 7310 AI博客论坛# AI开发者社区# AI模型库
闪剪 闪剪是一个先进的AI数字人视频生成平台,支持移动端APP版本,平台有丰富的数字人视频模板,用户只需输入关键词,闪剪AI即可自动创作文案一键生成数字人视频。闪剪还可在线定制专属数字人形象及声音,能够1:1复刻用户的形象和声音。闪剪提供200+国际化数字人模特、24+国家AI配音、AI文案创作、智能成片、照片数字人、直播快剪、视频订阅号等功能,让企业团队轻松实现矩阵营销引流,降本增效。 1,0810 AI数字虚拟人# AI 视频创作# 虚拟数字人
FAISS Faiss 是一个用于高效相似性搜索和密集向量聚类的库。它包含算法,可以在任何大小的向量集中进行搜索,直到可能不适合RAM的向量。它还包含用于评估和参数调整的支持代码。 6810 AI编程工具# AI向量数据库# AI编程
MaterialSearch AI本地文搜图、图搜图 MaterialSearch是一个支持中文的本地素材搜索工具,可以扫描本地图片和视频,并支持自然语言进行搜索。可以文字搜图、以图搜图、文字搜视频、以图搜视频、图文相似度计算、Pexels视频搜索 7310 AI图像工具# AI开源项目# AI编程
Buzz:离线开源免费语音转文字(字幕) 翻译站点 Whisper 是一种通用语音识别模型。它利用各种大型数据集上的音频进行训练,也是一个多任务模型,可以执行多语言语音识别以及语音翻译和语言识别。 在第一次使用 Buzz 的时候,会下载 Whisper 的模型,根据不同的质量要求,模型尺寸也非常可观: Whisper模型存储在~/.cache/wilsper中。 Whisper.cpp模型存储在~/Library/Caches/Buzz(Mac OS)、~/.cache/Buzz(Unix)或C:Users<username>AppDataLocalBuzzBuzzcache(Windows)中。 Hugging 模型存储在~/.cache/huggingface/hub中。 https://github.com/chidiwilliams/buzz 9810 AI语音识别-音转文# AI开源项目# AI编程# AI语音转文字
CapsWriter-Offline 语音输入 字幕转录工具 这是 CapsWriter-Offline ,一个 PC 端的语音输入、字幕转录工具。 两个功能: 视频教程: CapsWriter-Offline 电脑端离线语音输入工具 对 Windows 端: 其它系统: 模型说明: 下载地址: (百度网盘容易掉链接,补链接太麻烦了,我不一定会补链接。GitHub Releases 界面下载是最可靠的。) 1,4810 AI语音识别-音转文# AI加字幕/AI字幕翻译# AI开源项目# AI视频工具
Pickpic AI – PickPic是人工智能生成图像的聚合平台,集合了各种不同的AI生成平台的优质图像与提示词,并提供基于向量搜索的精准搜索服务 – 在PickPic中,用户首先可以任意浏览来自全球的用户上传的AI生成图片与提示词,并根据图片与提示词推荐相关的AI生成图片,用户也可以随时跳转至图片来源网站生成更多的图片 1,0610 AI绘画提示词# AI绘画# AI绘画提示词
AI gpt中转站支持GPT-4、Claude3 当前支持的模型: ✅GPT-3.5 所有版本以及 Embedding 官方接口:支持最新 gpt-3.5-turbo-0125、text-embedding-3-large、text-embedding-3-small 模型。 ✅GPT-4 所有版本官方接口:支持最新 gpt-4-0125-preview、gpt-4-turbo-preview、gpt-4-1106-preview、gpt-4-vision-preview 等模型 ✅GPT-4-32K 所有版本官方接口(32K 系列为老模型,价格贵)。 ✅OpenAI 文本转语音模型:tts-1、tts-1-1106、tts-1-hd、tts-1-hd-1106 ✅OpenAI 语音转文本模型:whisper-1 ✅OpenAI embedding 模型:text-embedding-ada-002、text-embedding-3-small、text-embedding-3-large(官网原价渠道,实际价格及倍率对标原价) ✅Claude3 模型:claude-2、claude-3-opus-20240229、claude-3- 7810 AI语音识别-音转文# AI应用接口API# AI编程
ComfyUI Github官方主页 翻译站点 ComfyUI 是一个基于节点流程式的stable diffusion AI 绘图工具WebUI, 你可以把它想象成集成了stable diffusion功能的substance designer, 通过将stable diffusion的流程拆分成节点,实现了更加精准的工作流定制和完善的可复现性。但节点式的工作流也提高了一部分使用门槛。 同时,因为内部生成流程做了优化, 生成图片时的速度相较于webui又10%~25%的提升 (根据不同显卡提升幅度不同), 生成大图片的时候不会爆显存 ,只是图片太大时,会因为切块运算的导致图片碎裂 ComfyUI整合包下载: 官方Release页面: github.com/comfyanonymous/ComfyUI/releases 分流度盘: pan.baidu.com/s/1d9XLF96OzWlLtUGvZiYdVA?pwd=nely 分流Quark: pan.quark.cn/s/ff8172bebe27 (无提取码,请完整复制所有链接) Comfy UI入门教程:ComfyUI全球爆红,AI绘画进入“工作流时代”?做最好懂的Comfy U 7010 AI学习网站# AI绘画# ComfyUI工作流
醒蓝AI 醒蓝AI是一款可以制作Al形象照、证件照、写真照的AI换脸软件。用户上传4-10张自拍,通过AI快速学习用户上传的照片来构建数字分身,继而产生无数风格的写真照片;醒蓝AI拥有超多时尚、优质、有趣的写真模板供用户选择,同时支持用户自定义上传模板进行换脸。 2,3810 AI图像处理# AI人像增强# 图片处理
千图设计室AI海报 千图设计室AI海报是千图网旗下的在线智能海报设计平台。千图设计室AI海报基于人工智能技术,为用户提供免费AI智能海报生成服务,用户只需输入简短的文字描述,即可快速生成节日海报、商品海报、公众号配图、电商主图、邀请函、日签、喜报等多种风格的海报。用户可以通过千图设计室AI海报一键稿定设计,满足个性化的图片设计需求。 2,1120 AI图像工具# AI 设计工具# 平面设计
Suno 非官方的API接口 翻译站点 这是一个基于 Python 和 FastAPI 的非官方 Suno API。它目前支持生成歌曲、歌词等。 它带有内置的令牌维护和保持活动功能,因此您不必担心令牌过期。 https://github.com/SunoAI-API/Suno-API —————————————————————— 使用 API 调用 suno.ai 的音乐生成 AI,并轻松集成到 GPT 等代理中。 https://github.com/gcui-art/suno-api 7710 AI音乐# AI应用接口API# AI编程
燕雀Logo 燕雀Logo为用户提供LOGO免费设计在线生成服务,适用于公司LOGO设计、品牌LOGO设计、企业LOGO设计等场景,无需下载软件,即可自己在线制作LOGO,并且提供源文件 7110 AI图像处理# AI 设计工具# Logo设计
FunClip自动化视频剪辑工具 FunClip是一款完全开源、本地部署的自动化视频剪辑工具,通过调用阿里巴巴通义实验室开源的FunASR Paraformer系列模型进行视频的语音识别,随后用户可以自由选择识别结果中的文本片段或说话人,点击裁剪按钮即可获取对应片段的视频 8510 AI视频后期# AI开源项目# AI编程# 视频剪辑
图应AI 图应AI(Tuing AI)是国内首批AI+IMaaS架构的商拍优化平台,专注于通过AI技术生成指定需求的优质商拍图像。垂直服务于服装商拍领域。提供一站式商拍优化解决方案。 图应AI经过大量数据专业训练,具备高智能化能力。无需场景实拍,可以根据素材,进行融合处理,在保留指定特征的基础上嵌入模型表征,自动生成真实场景或指定需求的商拍内容。 官网地址:https://feilianyun.cn/ 8110 AI图像处理# AI电商# 图片处理