AnythingLLM

AnythingLLM

一个具有高度定制化和隐私控制的聊天型人工智能,适用于各种规模的企业。它提供细粒度的多用户权限控制,可访问聊天记录等功能。同时,该系统兼容多种数据类型,如PDF、Word文档等,可进行与企业相关的各种数据操作。另外,AnythingLLM支持自定义模型,包括GPT-4、自定义模型以及像Llama、Mistral等开源模型。除此之外,用户还可以进行外部数据导入,并具备灵活的第三方控制和开源支持等特点。 功能点总结: 1. 高度定制化:适用于各种企业规模 2. 隐私控制:保护数据隐私,确保数据不离开用户实例 3. 多用户权限控制与安全:细粒度权限设置,符合合规要求 4. 数据兼容性:支持多种文档类型,如PDF、Word文档等 5. 自定义模型支持:不局限于单一提供商,可以使用企业模型或开源模型 6. 外部数据导入:用户可以上传PDF、Word文档等,拓展聊天机器人的知识库 7. 第三方控制与开源支持:自由选择第三方供应商,支持开源软件,提供透明性和定制化 8. 完整API支持和外观定制:提供全面的开发者API,外观可定制化 希望这能对您有所帮助。如果您有其他问题或需要进一步的解释,请告诉我。
8910
Deco

Deco

京东推出的设计稿一键生成多端代码, 插件适用范围 Mac ,目前仅支持 Sketch 工具 ,请确保安装 Deco 插件前,已经安装了 Sketch 工具 Deco 利用人工智能,结合各类自动化、工程化等手段,将 Sketch 、 PS 、 图片类 的设计稿转换生成还原度高、可维护强的代码,致力于突破业务生产力瓶颈,为前端大规模、高效率生产提供赋能。 Deco 对视觉稿没有严格的约束,工具对绝大多数场景都做了规则化的适配处理,但仍有少数场景无法完全覆盖: Deco 推荐的设计规范实践: 在设计前台一体化的体系中 Deco 承接设计交付的物料,结合插件标注及AI算法的处理,转化为标准化的楼层代码,实现开发流程的大幅度提效,快速获得楼层和页面,促进商业生产。 Deco 通过标准化的设计物料输入及楼层页面输出,帮助沉淀设计规范和统一开发标准,推进流程的标准化建设,降低人力成本和流程损耗,进一步提高生产质量。 码工具
8910
InsightFace

InsightFace

InsightFace是一个开源的2D和3D深度人脸分析库。 功能特点: 面部识别:InsightFace实现了最先进的面部识别算法,可以高效准确地进行人脸识别。它在CVPR 2019上被接受为最先进的面部识别方法。 面部检测:该库提供了RetinaFace,这是一种最先进的多任务面部检测方法。它在CVPR 2020上被接受,并能在复杂场景下实现高准确率的面部检测。 面部对齐:InsightFace提供了SDUNet和CoordinateReg等面部对齐方法。这些算法能够对面部进行准确的对齐,保证了后续处理的准确性。 易于使用和部署:InsightFace是一个易于使用的Python库,提供了方便的API接口,使得研究机构和商业组织可以轻松地使用和部署该库中的算法。 开源:InsightFace是开源的,用户可以自由地查看和修改源代码,以满足自己的需求。 强大的性能:InsightFace在多个面部分析挑战中取得了优异的成绩,包括在ECCV 2022 WCPA Challenge中获得第一名,在NIST-FRVT 1:1 VISA中获得第一名,在NIST-FRVT 1:1中排名第四。
8810
HierVST

HierVST

HierVST 是一种分层自适应零样本语音风格转换模型,它具备以下功能特点: 零样本语音风格转换:HierVST 可以在没有目标说话者语音数据的情况下,将一个新的说话者的语音风格转换为目标风格。这意味着即使没有目标说话者的语音样本,HierVST 也可以生成具有目标风格的语音。 分层自适应结构:HierVST 使用分层自适应生成器,逐步生成音高表示和波形音频,从而实现逐步转换语音的能力。这种结构让模型能够适应新的语音风格,并逐步进行转换。 自监督表示学习:HierVST 仅使用语音数据集进行训练,而无需使用文本转录。它采用了层次变分推断和自监督表示学习的方法,提高了模型在音频表示上的性能。 性能优于其他模型:在零样本语音风格转换场景中,HierVST 的实验结果表明其性能优于其他 VST 模型,如 AutoVC、VoiceMixer、DiffVC、Speech Resynthesis 和 YourTTS。
8710
pdf2htmlEX

pdf2htmlEX

一个用于将PDF文件转换为HTML格式的开源工具。它是由coolwanglu在GitHub上开发和维护的。这个工具的主要功能是将PDF文件中的文本、图像、表格等内容提取出来,并将其转换为可以在网页浏览器中显示的HTML格式。 pdf2htmlEX支持多种操作系统,包括Windows、Linux和macOS。它具有简单易用的界面,用户只需通过简单的命令行操作即可完成PDF到HTML的转换。此外,pdf2htmlEX还提供了一些高级功能,如自定义输出样式、设置转换参数等,以满足不同用户的需求。
8620
Coqui-TTS

Coqui-TTS

一个强大的深度学习文本到语音工具包,具有高度的可定制性和多语言支持。它提供了简单易用的界面和API,使用户能够快速进行文本到语音转换。同时,作为开源项目,用户可以免费使用和定制该工具包,以适应不同的应用场景和需求。 功能点: 1. 文本到语音转换:可以将文本转换成逼真的语音。它使用深度学习技术,通过模型训练来生成自然流畅的语音输出。 2. 高度可定制:提供了丰富的配置选项和模型参数,使用户可以根据自己的需求进行定制。可以调整声音的速度、音调、语气等参数,以获得满意的语音效果。 3. 多语言支持:支持多种语言,包括英语、中文、法语等。用户可以根据需要选择不同的语言模型进行文本到语音转换。 4. 易于使用:提供了用户友好的API和命令行界面,使用户可以轻松地使用该工具包进行文本到语音转换。
8510
Real-ESRGAN

Real-ESRGAN

一个用于图像和视频修复的应用程序,它使用ESRGAN模型进行训练,该模型使用合成数据进行图像和视频的恢复。它支持各种模型、选项和推理方法,并且提供在线和离线演示、更新和使用指南。 Real-ESRGAN旨在开发实用的通用图像/视频恢复算法,可以恢复各种来源的图像,如动画视频、照片和视频。 Real-ESRGAN ncnn Vulkan是Real-ESRGAN的ncnn实现版本,从realsr-ncnn-vulkan项目中汲取了许多灵感。 在使用Real-ESRGAN进行图像修复时,可以直接下载项目的执行程序进行运行。如果无法下载,可以使用提供的链接进行下载。 此外,Real-ESRGAN项目还提供了详细的使用说明和演示,包括图片测试修复超分和视频测试修复超分的步骤。 总的来说,Real-ESRGAN是一个功能强大的图像/视频修复工具,具有实用性强、操作简便等特点。
8510