标签「AI」下的文章,共找到 44 篇文章
FunASR-webui,音频转成文本
# FunASR-webui 用于将音频转成文本,例如会议录音转成文字记录、mp4视频文件转换成字幕文件等等。 ### 运行说明 
# 什么是人工智能 (AI)  李开复老师用通俗的语言来解释,人工智能、机器学习、神经网络、深度学习……这...
Clarity-Refiners-UI,图像增强,懒人包
# Clarity-Refiners-UI:图像增强与超分辨率重绘工具 用于图像增强,可以理解为将模糊的图片变清晰,将图像重绘放大超分。 ### 🚀 项目简介 **Pinokiofactory/Cla...
Diffusers-Image-Community,AI扩图,新版懒人包
AI扩图的使用非常简单,已经将原界面尽量简化了,就不做过多介绍了。 实在不懂,自己去看原作者刘锐视频讲解。我有B站账号,但是转正还得做很多题,还是免了。 **资源来源** * 转载自刘锐博客:[htt...
OmniGen,AI文生图,图生图,身份保留,懒人包
# OmniGen:AI 文生图、图生图、身份保留懒人包 ### 核心功能 * **多图融合**:你可以上传一到三张参考图片,并根据参考图片进行融合。 * **身份保留**:你可以上传一张照片,让模型...
nstantIR,AI图像修复
# InstantIR 开源项目介绍 InstantIR 是一个在 GitHub 上的开源项目。它采用了深度学习技术,通过使用深度神经网络学习图像的特征,从而更好地理解图像的内容,用于图像的相似度计算...
ComfyUI-精简版,懒人包
# ComfyUI-精简版,懒人包 ### 目录结构  --- ### 运行界面 运行后如果不是下图的工作流,可...
F5-TTS-main,根据参考语音生成语音,懒人包
# F5-TTS-main:根据参考语音生成语音 **整合包制作:** 数字生命卡兹克 我不认识他,整合包来自群友分享。在此基础上做了界面负优化,把我不想看到的都删除了。 ### 核心功能与用法 这可...
AI离线大模型加载工具,LM Studio
# AI 离线大模型加载工具:LM Studio ### 🔗 官网链接 [https://lmstudio.ai/](https://lmstudio.ai/) --- ### 💡 工具简介 这个工具...
UltraPixel高分辨率文生图
# UltraPixel 高分辨率文生图 UltraPixel 是一种由华为诺亚方舟实验室联合香港科技大学共同开发的超高清图像合成架构,旨在生成具有丰富细节的高质量图像,其分辨率可以从 1K 一直延伸...
diffusers-image-outpaint,智能扩图工具,懒人包,有更新
# diffusers-image-outpaint 智能扩图工具懒人包 PS 原版有扩图功能,但是老美不给用。 Diffusers Image Outpaint 是一个在 Hugging Face ...
腾讯开源GFPGAN图片无损放大,一键懒人包
# 腾讯开源 GFPGAN,一键懒人包 集显不用下载了,A卡也不用下载了,依赖 CUDA 生态。 这是 3 年前的老项目了,网上应该是有其他人做的懒人包,我懒得找。看见模型更新到 1.4 了,重新打包...
PhotoMaker_V2:人像面部可控高保真迁移,离线懒人包
# PhotoMaker V2: 人像面部可控高保真迁移 ### 项目资源 * **开源地址**: [https://github.com/TencentARC/PhotoMaker](https:/...
AI表情同步(表情迁移),含懒人包
# 利用 AI 模型重建静态图片,使其同步目标视频中的表情 (表情迁移) 利用 AI 模型重建静态图片,使其同步目标视频中的表情(表情迁移)。 **用人话说:** 上传一个人像图片,再上传一个你想复制...
目前生成式AI最大的短板是什么?
# 目前生成式AI最大的短板是什么?  如图,最大的短板应该是**默契**。 你不懂我,就算放一本百科全书加一...