首页
友情链接
全景相册
随机剧照
本站声明
壁纸
Search
1
diffusers-image-outpaint,智能扩图工具,懒人包,有更新
8,940 阅读
2
AIGC数字影像馆,键盘摄影大师(一键懒人包)
4,232 阅读
3
Diffusers-Image-Community,AI扩图,新版懒人包
3,275 阅读
4
三款离线OCR对比(供下载)
3,235 阅读
5
Deepseek本地部署(内置32B和14B模型)2月21更新
3,204 阅读
摄影类
茶余饭后
软件类
登录
Search
标签搜索
AI
园博园
五一
锦绣园
大模型
甘坑
重庆
荔枝公园
开源
懒人包
台湾
相机
大梅沙
沙井
大沙河
南头古城
锦绣中华
博物馆
华强北
一个公园
傻木摄影
累计撰写
656
篇文章
累计收到
150
条评论
首页
栏目
摄影类
茶余饭后
软件类
页面
友情链接
全景相册
随机剧照
本站声明
壁纸
登录
搜索到
161
篇与
的结果
2025-03-06
Spark-TTS,极简版音频克隆
Spark-TTS:极简版音频克隆核心功能如果你是播客主,或者经常在 B 站发布视频解说,可以使用这款工具:音色克隆:录制一段你说话的录音,即可用你的音色生成任意文本的音频。趣味应用:你可以让“猪八戒”给你讲故事,实现极具个性化的语音输出。使用方法非常简单:上传一段参考音频或者录制你自己的声音。输入你想转换成音频的文本。点击开始克隆即可。技术原理与优势Spark-TTS 是一款先进的文本转语音(Text-to-Speech,TTS)系统,它利用大型语言模型(Large Language Model,LLM)的强大功能,实现了高度准确且自然流畅的语音合成。该系统旨在为研究和生产使用提供高效、灵活且强大的解决方案。简洁与高效:完全基于 Qwen2.5 构建,无需额外的生成模型(如流匹配模型等)。通过直接从 LLM 预测的代码中重构音频,简化了流程,提高了效率并降低了复杂性。零样本语音克隆 (Zero-Shot Voice Cloning):支持在无需特定训练数据的情况下复制说话者的声音。这在跨语言和代码切换场景中尤为有用,允许在不同语言和声音之间无缝切换。多语言与个性化:支持中文和英文。通过调整性别、音调和语速等参数,可以创建虚拟说话者,提供个性化的语音合成体验。注意:Spark-TTS 主要用于学术研究、教育目的及合法应用(如辅助技术、语言学研究等)。用户应遵守法律法规,不得用于未经授权的冒充、欺诈、深度伪造或任何非法活动。版本优化说明下载地址: jian27打包我在 jian27 打包的基础上进行了“二次负优化”:瘦身减重:删减了不需要的 Web 界面及冗余文件(原包 5.99GB $\rightarrow$ 本站优化后 4.11GB)。Bug 修复:修复了原版文本输入框中含有“回车换行”时,仅能生成第一句的问题。本版本已支持回车不影响音频生成。性能优化:增加了显存回收功能。效果预期:音质大概能达到原音参考音频的 7 成左右。某些情况下转换出的音频语速会较快。硬件要求显卡:需要 NVIDIA 显卡(黄皮显卡)。显存:4GB 以上即可,推荐 6GB 以上。提示: 回复后刷新可以看见下载链接。隐藏内容,请前往内页查看详情
2025年03月06日
1,117 阅读
2 评论
0 点赞
2025-02-25
FunASR-webui,音频转成文本
FunASR-webui用于将音频转成文本,例如会议录音转成文字记录、mp4视频文件转换成字幕文件等等。运行说明操作流程:加载音频或者MP4文件点击开始按钮性能与输出:效率: 耗时视音频长度而不一,效率还是很高的。显存占用: 消耗显存约 2.5gb 左右。保存路径: 转换完成会在 out 目录自动保存为三个格式:一个 .txt 文件一个视频字幕文件一个音频歌词格式文件本站优化说明本站独家负优化:体积压缩: 显著减少体积,压缩包 3.2gb(原作 5.4gb)界面调整: web界面简化资源链接作者开源页面: https://github.com/gluttony-10/FunASR-webui视频教程(转载自 B站十字鱼): 点击观看百度网盘下载链接: (回复后刷新可见)隐藏内容,请前往内页查看详情
2025年02月25日
1,642 阅读
2 评论
0 点赞
2025-02-24
傻木摄影_文件批量重命名
傻木摄影_文件批量重命名顾名思义,这是一个用来批量重命名文件的工具。该工具由易语言编写,使用时可能会报毒。这是我用过最好的重命名工具,并非因为是我写的,而是其许多细小功能都是根据我的自身需求定制的。核心特点操作便捷:大多数操作不需要键盘输入。智能识别:载入需要重命名的文件夹并选择一个文件后,会显示旧文件名。在旧文件名中选择需要替换的部分,会自动粘贴到“原文件名”。如果选择了文件目录中的文字,则会自动粘贴到“替换件名”。功能说明批量删除内容:在“原文件名”中填入内容并点击重命名,会将该文件夹中所有包含该内容的文件进行删除处理。批量替换内容:将“原文件名”的内容批量替换为“替换件名”。快速定位:右键点击文件目录,会自动打开该目录。高级重命名:可以批量加前缀。可以批量加后缀。可以进行有条件重命名(例如删除左起几位、右起几位等)。该工具可以满足日常绝大部分重命名需求,设计已经足够简单,更多功能建议自行摸索。软件回复刷新,可见下载链接隐藏内容,请前往内页查看详情
2025年02月24日
463 阅读
0 评论
1 点赞
2025-02-21
Deepseek本地部署(内置32B和14B模型)2月21更新
首次使用需要联网下载 install open-webui 组件(过程是自动的),之后就不用联网了。资源信息DeepSeek 本地部署:由剑二十七制作分享更新地址:https://www.jian27.com/html/1396.html (此版压缩包 40gb+)配套教程:DeepSeek从入门到精通.pdf本站独家“负优化”说明以下为本站针对显存优化的策略(优化后带两个模型总体积 14.4gb):1. 量化策略模型已替换为 Q2 量化版,显存占用大幅降低,6gb 以上黄皮显卡可玩。核心原则:在显存不够的情况下,优先选择“降低精度且模型体量大”的方案。例如:14b Q2 量化版,远比 8B fp16 效果好得多。在体量面前谈量化,那就是扯淡。2. 模型配置模型只保留了 14b 和 32b。显存占用参考:14b:实际运行占用约 5.5gb 显存。32b:实际运行占用约 11gb 显存。自定义替换:可以自己替换喜欢的模型,原则上 .gguf 后缀的模型都可以(例如某些无限制模型)。注:怎么替换请自行研究,不做解答。安装与使用指南1. 根目录优化刚刚更新的版本只是优化了根目录,看起来更简洁,更适合强迫症患者。2. 首次启动步骤开始使用:首次启动时,点击“开始使用”。账号设置:输入昵称(随便输)。默认管理员账号:jian27@126.com 或 123@123.com默认密码:1234进去后可自行修改。注意:这一步可能会白屏(浏览器什么都不显示),请耐心等待几秒钟。更新信息:3. 模型选择与设置根据你的电脑硬件情况选择模型:显存 < 8gb (N卡):建议选择 14b(最低要求 6gb 显存)。显存 > 12gb:可以跑 32b。详细设置:右上角有详细设置及账户设置等。联网搜索:可以设置联网搜索,但需要申请 API(属于各家搜索引擎收费项目,非本项目收费)。更多好玩的,请自己摸索。文件下载通过百度网盘分享的文件:DeepSeek-tool_V3.03.7z(回复后,刷新可见下载链接)下载链接:https://pan.baidu.com/s/1SaMyVC5Wn-yVdWXS3emM2Q?pwd=gpcb
2025年02月21日
3,204 阅读
10 评论
5 点赞
2025-02-13
Sonic,一键包,数字人工具,音频驱动图片说话,腾讯联合浙大开源
Sonic:腾讯联合浙大开源,一键包数字人工具关键词:Sonic, 一键包, 数字人工具, 音频驱动图片说话, 腾讯联合浙大开源💡 项目简介用人话介绍:给一张图片,给一段音频,它会根据音频内容让图片转成视频,并配合音频自动调整嘴型以及面部表情。转载自B站十字鱼:点击观看视频官方项目地址:https://github.com/jixiaozhong/Sonic✨ 本站优化内容针对原版进行了以下“负优化”(优化):体积瘦身:减肥 2GB界面汉化:全中文界面体验精简页面:删除了页面多余的示例目录优化:优化了文件目录,看起来更清爽性能提升:增加了显存回收功能🖼️ 效果展示效果图完整界面📥 下载链接百度网盘:https://pan.baidu.com/s/1G1Hl3DFqJq8ObnA2ujNRbQ?pwd=gpcb
2025年02月13日
458 阅读
0 评论
0 点赞
2025-01-15
多任务定时执行工具
多任务定时执行工具这几天写了个 PHP 中间件,用来扫描 ERP 数据库数据,定时发送到企业微信群里。由于没有找到符合要求的定时执行程序,就自己写了一个。工具特点使用简单:设置好程序路径与时间,到时间会自动执行。运行方式:运行时请不要关闭窗口。任务容量:最多可以设置 9 个任务。源码提供:压缩包内提供源码,可以根据实际情况自行修改。注意事项不提供技术支持。下载地址https://abpyu.lanzoul.com/iDCCD2l1511c
2025年01月15日
370 阅读
0 评论
0 点赞
2024-12-20
图片文件自动命名工具
图片文件自动命名工具开发背景这几天帮老板扫描旧照片,大约有千张之多。普通扫描仪一次能扫5张,后续 PS 裁剪成单张。输出时我录制了一个脚本,自动输出到指定的文件夹,但这会带来一个后果:当前打开的图片名称是 123.jpg输出的 5 张都是 123.jpg也就是说,后面输出的都会覆盖掉前面输出的图片除非每次输出后,手动重新命名。工具实现方案在裁剪完前面两个相册之后,我做了个工具:核心功能:监听指定文件夹,收到新图片时,按照当前时间戳自动重命名。解决冲突:由于 PS 输出文件时,会先生成一个临时文件,待完全输出后,再重新命名;因此工具做了 4 秒钟的延时,待 PS 完成输出之后,再自动重新命名。用了几天,相当稳定。只需选择目标文件夹,点击开始监听即可。获取方式老样子,回复可见。软件包内有源码和打包好的 exe。如果功能不适合你,请你自己再改改;如有你改好的、更好用的,欢迎分享给我。下载链接:https://abpyu.lanzoul.com/inSlI2iksmhi
2024年12月20日
722 阅读
0 评论
1 点赞
2024-12-12
iStoreOS 路由器设置备忘
iStoreOS 路由器设置备忘最近在折腾 iStoreOS 系统。这是一个开源的路由器系统,功能强大。我安装在京东 AX1800 pro 上,可能是硬件原因,自带的 app 很多装不上,能装上的极其有限,还有某些坑。软件源配置 (opkg.conf)首先需要配置软件源,内容如下:dest root / dest ram /tmp lists_dir ext /var/opkg-lists option overlay_root /overlay arch all 1 arch noarch 1 arch aarch64_cortex-a53+crypto 10 arch aarch64_cortex-a53 100 src/gz openwrt_base http://mirrors.pku.edu.cn/immortalwrt/releases/21.02.1/packages/aarch64_cortex-a53/base/ src/gz openwrt_luci http://mirrors.pku.edu.cn/immortalwrt/releases/packages-18.06-k5.4/aarch64_cortex-a53/luci src/gz openwrt_packages http://mirrors.pku.edu.cn/immortalwrt/releases/21.02.1/packages/aarch64_cortex-a53/packages src/gz openwrt_routing http://mirrors.pku.edu.cn/immortalwrt/releases/21.02.1/packages/aarch64_cortex-a53/routing src/gz openwrt_telephony http://mirrors.pku.edu.cn/immortalwrt/releases/21.02.1/packages/aarch64_cortex-a53/telephony # add your custom package feeds here # # src/gz example_feed_name http://www.example.com/path/to/files安装步骤然后在终端依次执行以下命令。注意:执行完第二句时,可能需要重启,之后再执行第三句。更新软件列表:opkg update安装 Docker 中文语言包:opkg install luci-i18n-docker-zh-cn安装 Docker Manager 中文语言包:opkg install luci-i18n-dockerman-zh-cn安装效果前面装了很多软件,没有截图。现在就装了三四个,没装那么多了。
2024年12月12日
447 阅读
0 评论
0 点赞
1
...
7
8
9
...
21
网站版权本人所有,你要有本事,盗版不究。 sam@gpcb.net