Inshellisense

Inshellisense

微软新推出了一款Shell小插件,名为Inshellisense,它能够提供IDE风格的下拉菜单式自动补全功能,非常实用。 该插件的效果可以从提供的图片中看到。它支持600个命令,对于使用过fig的用户来说,应该会感到非常亲切,因为它将fig底层的autocomplete功能单独提取出来并制作了一个本地的运行时环境。 该插件没有使用任何花哨的AI技术,而是通过命令集合提示来提供自动补全功能。虽然功能相对简单,但是对个人用户来说非常实用。
1,2510
SillyTavernAI角色聊天界面

SillyTavernAI角色聊天界面

SillyTavern(或简称 ST)是一个本地安装的用户界面,允许您与文本生成 LLM、图像生成引擎和 TTS 语音模型进行交互。 一个可以本地部署的虚拟角色聊天软件,支持多种虚拟角色,也可以自己创造角色,后台可以连多种不同LLM,比如OpenAI、Claude、Llama等,支持TTS(文字转语音) 支持中文、英文、日文、韩文等多语言 由于 SillyTavern 只是一个界面,您需要访问 LLM 后端才能进行推理。您可以使用 AI Horde 进行即时聊天。除此之外,我们还支持许多其他本地和基于云的 LLM 后端:兼容 OpenAI 的 API、KoboldAI、Tabby 等等。您可以在 文档 中了解更多关于我们支持的 API 的信息。 硬件要求极低:任何支持 NodeJS 18 或更高版本的设备均可运行,(电脑端、手机端均可运行下载) 如果您打算在本地机器上进行 LLM 推理,我们建议您使用 3000 系列 NVIDIA 显卡,并至少配备 6GB VRAM。更多详情,请查看您后端的文档。 SillyTavern 围绕”AI角色卡片”的概念构建。角色卡片是一系列设定 LLM 行
7410
TryOnDiffusion

TryOnDiffusion

Tryon Diffusion 是一个实时演示项目,尤其适用于虚拟试穿场景。它不仅迅速将用户的想法转化为精美的艺术作品,而且提供了丰富的资源。这类技术的另一个优点就是能提供充满活力的风格和颜色多样。用户可以尝试各种不同的艺术风格,使其快速地对自己的作品感受良好。 此项目在GPU性能方面具有较高的要求,因为合成高分辨率图像通常要求大量计算资源。有关错误信息与性能方面的讨论可在 GitHub 上找到,例如有关“CUDA out of memory”问题。这类问题可以通过调整参数及参考文档中的内存管理和 Disco 变分技巧进行解决。 总之,Tryon Diffusion 是一个实时演示项目,旨在利用先进的潜在扩散技术和算法创作出高质量的虚拟试穿体验。该技术不仅具有颠覆性创新潜力,而且对于广泛行业领域的应用具有极大价值。
6410
PASD

PASD

一个功能强大的开源图像处理工具,它能够实现真实感图像的超分辨率和个性化的风格化。该工具不仅可以将低分辨率的图像转换为高分辨率版本,而且还能保持或增强图像的真实感。它具备多种处理任务的能力,包括但不限于图像超分辨率、旧照片修复、个性化风格化(例如将照片转换为动漫风格)以及图像上色等。举个例子,你可以使用PASD来恢复家族旧照片的细节,或者将普通照片转换成具有独特艺术风格的作品。
7110
Coqui-TTS

Coqui-TTS

一个强大的深度学习文本到语音工具包,具有高度的可定制性和多语言支持。它提供了简单易用的界面和API,使用户能够快速进行文本到语音转换。同时,作为开源项目,用户可以免费使用和定制该工具包,以适应不同的应用场景和需求。 功能点: 1. 文本到语音转换:可以将文本转换成逼真的语音。它使用深度学习技术,通过模型训练来生成自然流畅的语音输出。 2. 高度可定制:提供了丰富的配置选项和模型参数,使用户可以根据自己的需求进行定制。可以调整声音的速度、音调、语气等参数,以获得满意的语音效果。 3. 多语言支持:支持多种语言,包括英语、中文、法语等。用户可以根据需要选择不同的语言模型进行文本到语音转换。 4. 易于使用:提供了用户友好的API和命令行界面,使用户可以轻松地使用该工具包进行文本到语音转换。
8510