由 Tohrusky 开发的一款图像超分辨率技术,它可以以更高的分辨率和质量重构图像。
DeepFaceLive是一个用于PC流...
一个强大的自动化视频制作工具,它可以自动采集素材、编辑视频、配音、生成字幕,从而简化了视频创建过程
一个使用类型来构建自然语言界面的库。
纯 C 语言实现的 Llama 2 推理引擎
一种用于构建人工智能代理的反应式运行时
用于在OS X/Linux系统中同步应用程序的设置
一个统一可控的视觉生成模型
Facebook Research开发的Audiocraft音频处理和生成库
一种分层自适应零样本语音风格转换模型
一款智能编程助手,具备代码审查、理解需求并自动编写和提交代码更改的功能
一家主导稳定扩散模型的创意引擎公司,利用最新的人工智能技术,为专业人士、艺术家和爱好者提供生成和创建视觉媒体的能力
文本来生成具有艺术风格的Cinemagraph动态图片
识别视频中的人物的面部和身体动作,为后续的SD绘图提供支持
一个多代理框架,可根据一行要求生成 PRD(产品需求文档)、设计、任务和存储库
一键免费部署私人 ChatGPT+Midjourney 网页应用 支持原ChatGPT-Next-Web所有功能 还额外支持AI绘图、图片放大、识图、 混图、垫图等等功能
一个可以将自己的照片上传并生成数字孪生的应用程序
AI 画图工具,它结合了 Stable Diffusion 和 Midjourney 的优点
Sketch-a-Sketch是一个公开的...
一个公共的代码存储库,主要用于BIliBili视频网站、抖音以及人工智能(AI)方面的虚拟主播项目
一个自助托管的、离线的聊天机器人
声音克隆和对话交互。它允许用户与喜欢的角色进行沉浸式对话,通过使用ChatGLM2模型和SadTalker模型来生成对话内容,并结合声音克隆技术实现角色的真实声音
一个将稳定扩散模型引入Web浏览器的项目
通过将静态内容与时间变形结合,为视频处理提供了新的视角和工具
腾讯开源的AI模型GFPGAN,能帮助恢复老照片
一款下一代的人脸交换和增强应用程序
一个模型,它提供了运行推理的代码、训练模型的检查点下载链接以及示例笔记本。
一个用于实施代码的推理模型的项目。它提供了一种简便的方法来使用训练好的模型,以便生成代码。
一个开源的2D和3D深度人脸分析库
输入文字即可编辑视频,包括修改风格、修改局部画面、视频混合、视频扩展。
输入文本、视频、音频,生成带动作的虚拟角色。
一个基于飞桨(PaddlePaddle)的跨模态大模型开发套件,旨在聚合图像、文本、视频等多种模态,以支持各种跨模态任务
一个基于隐式空间的图像超分辨率算法,图像超分辨率任务的目标是将低分辨率图像转换为对应的高分辨率图像
结合OpenAI API,在本地运行代码解释器,可以联网,有更全的库,不限制文件大小和运行时间
通过动画的形式展示了所有 LeetCode 上的问题的解题思路
一款免费开源的漫画生成器,采用LLM和SDXL技术,用户只需输入提示词即可生成类似漫画风格的图片