SillyTavernAI角色聊天界面

SillyTavernAI角色聊天界面

SillyTavern(或简称 ST)是一个本地安装的用户界面,允许您与文本生成 LLM、图像生成引擎和 TTS 语音模型进行交互。 一个可以本地部署的虚拟角色聊天软件,支持多种虚拟角色,也可以自己创造角色,后台可以连多种不同LLM,比如OpenAI、Claude、Llama等,支持TTS(文字转语音) 支持中文、英文、日文、韩文等多语言 由于 SillyTavern 只是一个界面,您需要访问 LLM 后端才能进行推理。您可以使用 AI Horde 进行即时聊天。除此之外,我们还支持许多其他本地和基于云的 LLM 后端:兼容 OpenAI 的 API、KoboldAI、Tabby 等等。您可以在 文档 中了解更多关于我们支持的 API 的信息。 硬件要求极低:任何支持 NodeJS 18 或更高版本的设备均可运行,(电脑端、手机端均可运行下载) 如果您打算在本地机器上进行 LLM 推理,我们建议您使用 3000 系列 NVIDIA 显卡,并至少配备 6GB VRAM。更多详情,请查看您后端的文档。 SillyTavern 围绕”AI角色卡片”的概念构建。角色卡片是一系列设定 LLM 行
7410
Inshellisense

Inshellisense

微软新推出了一款Shell小插件,名为Inshellisense,它能够提供IDE风格的下拉菜单式自动补全功能,非常实用。 该插件的效果可以从提供的图片中看到。它支持600个命令,对于使用过fig的用户来说,应该会感到非常亲切,因为它将fig底层的autocomplete功能单独提取出来并制作了一个本地的运行时环境。 该插件没有使用任何花哨的AI技术,而是通过命令集合提示来提供自动补全功能。虽然功能相对简单,但是对个人用户来说非常实用。
1,2510
TryOnDiffusion

TryOnDiffusion

Tryon Diffusion 是一个实时演示项目,尤其适用于虚拟试穿场景。它不仅迅速将用户的想法转化为精美的艺术作品,而且提供了丰富的资源。这类技术的另一个优点就是能提供充满活力的风格和颜色多样。用户可以尝试各种不同的艺术风格,使其快速地对自己的作品感受良好。 此项目在GPU性能方面具有较高的要求,因为合成高分辨率图像通常要求大量计算资源。有关错误信息与性能方面的讨论可在 GitHub 上找到,例如有关“CUDA out of memory”问题。这类问题可以通过调整参数及参考文档中的内存管理和 Disco 变分技巧进行解决。 总之,Tryon Diffusion 是一个实时演示项目,旨在利用先进的潜在扩散技术和算法创作出高质量的虚拟试穿体验。该技术不仅具有颠覆性创新潜力,而且对于广泛行业领域的应用具有极大价值。
6410
PASD

PASD

一个功能强大的开源图像处理工具,它能够实现真实感图像的超分辨率和个性化的风格化。该工具不仅可以将低分辨率的图像转换为高分辨率版本,而且还能保持或增强图像的真实感。它具备多种处理任务的能力,包括但不限于图像超分辨率、旧照片修复、个性化风格化(例如将照片转换为动漫风格)以及图像上色等。举个例子,你可以使用PASD来恢复家族旧照片的细节,或者将普通照片转换成具有独特艺术风格的作品。
7110
Coqui-TTS

Coqui-TTS

一个强大的深度学习文本到语音工具包,具有高度的可定制性和多语言支持。它提供了简单易用的界面和API,使用户能够快速进行文本到语音转换。同时,作为开源项目,用户可以免费使用和定制该工具包,以适应不同的应用场景和需求。 功能点: 1. 文本到语音转换:可以将文本转换成逼真的语音。它使用深度学习技术,通过模型训练来生成自然流畅的语音输出。 2. 高度可定制:提供了丰富的配置选项和模型参数,使用户可以根据自己的需求进行定制。可以调整声音的速度、音调、语气等参数,以获得满意的语音效果。 3. 多语言支持:支持多种语言,包括英语、中文、法语等。用户可以根据需要选择不同的语言模型进行文本到语音转换。 4. 易于使用:提供了用户友好的API和命令行界面,使用户可以轻松地使用该工具包进行文本到语音转换。
8510
dot

dot

dot是一个开源的深度伪造工具包,用于生成逼真的深度伪造视频和图像。该工具包是由Sensity AI开发的,可以在GitHub上免费下载和使用 。使用dot需要安装一些依赖库,如conda和pip,以及下载一些模型文件 。该工具包是基于多个开源项目构建的,包括first-order-model、avatarify-python、SimSwap和GPEN等 。Sensity AI是一个人工智能公司,其GitHub页面上还有其他的开源项目 。如果使用dot,需要遵守其所依赖的开源库的许可证 。
7620
OpenVoiceOS

OpenVoiceOS

OpenVoiceOS 是一个社区支持的 Linux 发行版,专门用于展示开源语音 AI 在各种设备上的强大功能 。它基于 Raspberry Pi,旨在为智能家居和机器人控制提供语音控制能力 。OpenVoiceOS 提供了详细的安装、配置和使用说明,包括如何在 Raspberry Pi 上安装和配置系统、训练自己的语音助手以及添加语音控制功能等。此外,OpenVoiceOS 还提供了一个基于云的语音识别服务,用户可以使用该服务来处理和识别来自语音助手的请求。该系统支持多种语言,包括英语、法语、西班牙语、葡萄牙语、德语等。总之,OpenVoiceOS 是一个实用的工具,可帮助用户将语音控制添加到他们的项目中,无论是构建智能家居还是机器人,都可以实现更好的交互和控制 。
9610
clone-voice

clone-voice

这是一个声音克隆工具,可使用任何人类音色,将一段文字合成为使用该音色说话的声音,或者将一个声音使用该音色转换为另一个声音。 使用非常简单,没有N卡GPU也可以使用,下载预编译版本,双击 app.exe 打开一个web界面,鼠标点点就能用。 支持 中、英、日、韩、法、德、意等16种语言,可在线从麦克风录制声音。 为保证合成效果,建议录制时长5秒到20秒,发音清晰准确,不要存在背景噪声。 英文效果很棒,中文效果还凑合。
7710