首页
友情链接
全景相册
随机剧照
本站声明
壁纸
Search
热门文章
1
diffusers-image-outpaint,智能扩图工具,懒人包,有更新
9,424 阅读
2
AIGC数字影像馆,键盘摄影大师(一键懒人包)
4,496 阅读
3
Diffusers-Image-Community,AI扩图,新版懒人包
3,546 阅读
4
Deepseek本地部署(内置32B和14B模型)2月21更新
3,493 阅读
5
三款离线OCR对比(供下载)
3,360 阅读
摄影类
茶余饭后
软件类
登录
Search
标签搜索
AI
园博园
五一
大模型
锦绣园
甘坑
重庆
台湾
荔枝公园
开源
懒人包
相机
大梅沙
沙井
大沙河
南头古城
锦绣中华
博物馆
华强北
一个公园
傻木摄影
累计撰写
676
篇文章
累计收到
160
条评论
首页
栏目
摄影类
茶余饭后
软件类
页面
友情链接
全景相册
随机剧照
本站声明
壁纸
登录
搜索到
44
篇与
AI
的结果
2026-09-23
Qwen-Image-2.1_文生图_编辑图片
Qwen-Image-2.1 文生图 / 图片编辑显卡兼容与安装说明适配范围:2系到5系显卡,解压即用,免安装。最新V5版 针对 Quadro P5000、RTX 2060 等老显卡已做优化,现在也能顺利运行了。需要注意的是,老显卡不支持新的加速器,出图速度会偏慢。链接: https://pan.baidu.com/s/1oyIJfs_3lqERv-S3tZ8iRg?pwd=gpcb已更新 V2 版,程序经过优化,可根据实际显存大小和任务需求动态调整显存占用,目前 8GB 显卡即可流畅运行。安装步骤: 请下载原始懒人包后,将本补丁解压到项目根目录中,然后运行补丁版即可。实测 6GB 显存即可出图,效率会略低一些——由于显存不足,模型会在显存与内存之间根据实际需求动态调换。功能特性这次千问的新模型,还是有点东西的。效果看起来相当不错,量化之后 6GB 显卡也能玩。一键懒人包 10.5GB 大小,目前应该是最小体积的一款了。自带大量预设,到手解压即用(本站以效率优先,最低 6GB 显卡即可)。集成了四百多个提示词,点击提示词即可直接植入编辑框。文生图: 不上传参考图,只填写提示词图片编辑: 上传参考图,可对图片进行编辑修改,例如美颜等多图支持: 可同时上传多张参考图运行注意事项NET8 运行库: 如果不能运行,请按照提示安装 NET8 运行库。显存占用提醒: 加载参考图会极大推高显存占用,图片理解模型约需 5GB 显存。
2026年09月23日
30 阅读
0 评论
0 点赞
2026-09-21
AI网络设备拓扑图设计工具
网络设备拓扑图设计工具模型使用的5090显卡加载的 Ornith-1.5-35B-A3B 速度快,不限token数,但是智商有限可以接入其他家的模型,提高纠错能力更新,数据保存到sqlite数据库中更新,支持用户管理,设置界面归纳到管理员界面,默认不支持新用户注册网页上画的图纸,重要的,请自己导出josn文件,或者导出pdf更新,用户隔离,A用户画的图不会被B用户看见更新,支持自定义AI大模型更新,支持有偿私有化部署更新AI优化等细节关于私有化部署的,平台不限,windows或者其他系统均可,优先win系统可以增加用户管理等基本功能,当前版本实际已有简单的用户管理,只不过隐藏了可以根据具体需求再开发大版本更新更新,AI对话区可以收起,鼠标扫过右侧自动展开报告页面支持MD格式,针对AI给出的表格做了优化支持AI纠错,点击一下按钮,全自动分析并自动修改错误支持AI推荐,根据当前图纸方案,查缺补漏,例如在合适的节点增加堡垒机各面板的pdf输出做了优化,以及其他细节优化目前市面上没有此类产品,独一份更新上线了 AI 智能分析功能——画好拓扑图后,点击AI分析,自动生成简要报告;如需更详尽的分析,可点击「重新分析(深度整改)」生成更详细报告。整改报告支持导出为 PDF。另外,我画了一个错误的示例,用来做AI分析的,请勿当真.点击打开按钮就能看到示例图了这是一款面向安防、机房方案设计的网页画图工具,让你直接在浏览器里绘制专业拓扑图:从设备库拖入交换机、路由器、电脑、监控等设备,连上线、标注端口等等,保存后即可导出图片或 PDF,直接嵌入方案文档。点我开始画图能做什么丰富设备库:内置云端、线路、网络、本地、监控等设备,支持搜索与自定义批量生成:电脑、交换机、摄像头等一次可放置多台灵活连线:直角折线,铜缆 / 光纤可选,自动占用空闲端口智能对齐:交换机在上、电脑在下平行排列,走线尽量不相交智能避让:名称、端口、连线标注自动躲开线条,图面更清爽便捷管理:保存到服务器,导出 PNG / JPG / PDF高效编辑:撤销重做不限步数,支持亮色 / 暗色主题与全屏模式五步会用1. 放入设备从左侧设备库双击即可放入画布。需要多台时,双击设备后填写数量即可批量生成。2. 连线点击「连线」按钮,先点选源设备,再点选目标设备;再次连线时需重新选择源设备。3. 移动在「选择」模式下可拖动设备:空白处左键拖拽框选多台,右键拖拽平移画布,滚轮缩放视图。4. 对齐连线完成后点击橙色「智能对齐」按钮;若不满意,撤销即可重排。5. 保存修改标题后点击「保存」,右上角可导出 PNG 或 PDF 文件。常用操作改名称 / IP / 端口:双击设备改网线类型、两端端口:双击连线看全图:双击画布空白处保存 / 另存 / 打开:Ctrl+S Ctrl+Shift+S Ctrl+O撤销 / 删除:Ctrl+Z Delete示例图纸只能另存,无法覆盖或删除。打开浏览器即可使用,图纸保存在服务器;需要带走文件时,请使用「下载 JSON」功能。
2026年09月21日
258 阅读
2 评论
0 点赞
2026-09-11
“AI 教父”辛顿:AI 灾难越来越近
“AI 教父”辛顿:AI 灾难越来越近,10% 概率灭掉人类不是危言耸听北京时间 9 月 11 日,据《商业内幕》报道,“AI 教父”杰弗里 · 辛顿 (Geoffrey Hinton) 表示,很难估计 AI 将人类全部灭绝的概率,但这个概率并非为零。辛顿周三接受了 BBC《新闻之夜》的采访,他表示:“在我看来,10% 的概率似乎是一个不算离谱的估计,但实际上没人知道该如何给出一个合理的估计。”《新闻之夜》主持人维多利亚 · 德比希尔 (Victoria Derbyshire) 对此表示惊讶,因为辛顿基本认同了 Anthropic 顶级 AI 安全研究人员雅各布 · 考克森 (Jacob Coxon) 的判断。该研究员表示,未来 10 年内,AI“有超过 10% 的概率杀死全人类”。“哇,”德比希尔说,“我的天哪。”难以估计具体概率辛顿表示,很难估计具体概率,因为人类社会从未见过一种“很快就可能比我们更聪明”的技术。“如果说只有 1% 的概率,那就太愚蠢了,”他说,“没有人知道该如何估算。”这位诺贝尔奖得主表示,可以确定的是,这种灾难可能发生的时间窗口已经缩短了。“我以前认为是 30 到 50 年,后来缩短到 10 到 20 年”“现在,我觉得可能是 10 年,甚至更短”“而其他人认为比这还要快得多。”灾难可能如何发生至于这种情况可能如何发生,辛顿提到了从网络攻击到 AI 研发出致命病毒等各种风险。尽管辛顿没有说明为什么这一时间表被大幅缩短,但包括 Anthropic 和 OpenAI 在内的领先 AI 公司已经投入数十亿美元来扩大模型规模,而它们最近发布的产品相比数月前的模型已展现出显著提升。“那些开发 AI 的人真心相信,AI 可能在这个十年结束前杀死我们所有人,”考克森在 X 上写道,“这不是营销噱头。”如果说有什么不同,那就是许多高管和资深研究员在媒体上会措辞谨慎,让自己听起来理性,但他在私下听到的是同一批人表达恐惧。呼吁加强全球监管辛顿表示,人类可能走上自我毁灭的道路,也可能在实现 AI 潜力的同时,找到“如何应对 AI 所带来危险”的办法。他再次呼吁加强全球监管,并指出尽管各国可能无法在所有问题上达成一致,但它们都有维护人类生存的共同愿望。“对于防止 AI 取代人类这类问题,各国的利益是一致的。因此,它们最终会展开合作。”他表示,“问题在于,他们能及时采取行动吗?”本文转载
2026年09月11日
55 阅读
0 评论
0 点赞
2026-08-15
你需要知道的 AI 缓存知识
大模型的价格大模型的价格,主要是 Token 的输入价格和输出价格,这个很容易理解。但是,还有一项"输入 Token 的缓存命中价格",这是什么东西?上图是 DeepSeek V4 模型的定价,可以看到缓存命中的输入价格只有5分钱,足足是未命中的输入价格的三十分之一!为什么相差这些大?我们能不能充分利用缓存,来降低费用呢?我对于这些问题,以前也不是很了解,最近看了一篇文章,终于理清了思路,今天就来分享。(1)模型输入的收费原因大家知道,使用大模型的时候,需要先有提示词。大模型会将提示词分解成 Token,再将 Token 转成向量值,然后计算所有 Token 之间的注意力关系。这一步非常消耗算力,因此模型公司会对输入 Token 收费。你的提示词越多,输入 Token 的费用就越高。(2)输入缓存的作用对于多轮对话和长程任务,每一轮都需要把以前步骤的输入输出结果,提交给模型。我们可以想到,这些每一轮额外增加的提示词是不变的,以前都已经处理过了。模型完全不必要对这些"前缀"每次进行重复计算,只要把以前的计算结果缓存起来,下一次再取出来用就行了。这就是为什么需要缓存,它可以大大节省不必要的算力消耗,加快模型处理。这也是它便宜的原因,因为只要命中缓存,基本不消耗算力,收取的费用实际上是储存空间的费用。(3)缓存的时间期限缓存有时间期限,长期保存并无意义。如果一段时间没有用到这些缓存,服务器就会把缓存删除。根据前面引用文章的测试,各家公司的缓存保存时间不一样。Anthropic:5分钟DeepSeek:10分钟OpenAI:10分钟~30分钟逐步失效Google:1小时内逐步失效以 DeepSeek 为例,在10分钟以内,缓存就是有效的,命中缓存只收取2分钱。如果对话的间隔特别久,下一次输入跟上一次之间超过了10分钟,缓存就被删除了,模型收到上一轮的提示词,就不得不重新计算,收取的费用就变成了1元。(4)保持缓存有效由于缓存命中与未命中之间,有巨大的价差。用户的 AI Agent 工具往往会想办法,尽可能延长缓存的保存时间。当用户长时间不操作、也不退出的时候,大多数 AI Agent 会每隔30秒,自动向服务器发送一个请求,让缓存保存激活状态。有些模型有专门的缓存激活接口,还有一些没有。这时可以用笨办法,Agent 自动重复发送一次以前的提示词,确保缓存激活。不过,激活请求也会产生费用。每隔30秒发送一次,如果10分钟没有输入,就会发送20个激活请求。时间一长,费用也不低。前面说过了,现在各家模型的实际缓存期限,最短也有5分钟,因此30秒一次的激活请求,似乎频率太高了。所以,最新的建议是,可以改成每4分钟自动激活一次缓存。本文转载
2026年08月15日
150 阅读
0 评论
0 点赞
2026-08-04
对话式3D建模,CAD Chat
对话式3D建模:CAD Chat运行效果展示项目资源与地址核心开源项目地址https://github.com/earthtojake/text-to-cad本项目重构版地址(正在完善中)https://github.com/abpyu/text-to-cad-local-chat网盘下载地址https://pan.baidu.com/s/1OiHjlcjWYVU7TnKJrL9O3w?pwd=gpcb项目特点与进展功能改进: 本项目基于上述开源项目进行重构。原项目每次对话仅能生成单个模型,而本项目支持通过多次对话持续修正模型。工作流: 用户上传参考图并提供基本信息后,系统即可输出大致形态,随后可通过连续对话进行细节微调。未来计划: 正在开发“参考图建模”功能,旨在探索“照葫芦画瓢”式的精准建模能力。当前阶段: 目前尚不具备实际生产能力,主要用于验证自然语言驱动建模的可行性。参考图建模演示
2026年08月04日
149 阅读
0 评论
0 点赞
2026-07-22
视频水印去除工具,台标去除工具
操作流程加载视频文件夹框选需要出去的图案注意:不要框选得太大,也不要太小目前只能固定区域效果说明对动画片效果比较好,其他视频可能差些效率很高(例如:3分半视频,20秒即可除去)资源下载链接: https://pan.baidu.com/s/1qD6pz0LC_9uNhDmrFxHFJw?pwd=gpcb版本与价格试用版: 供 72 小时全功能试用包年版: 99 元(需在线验证)不限时长版: 199 元(需在线验证)离线授权: 456 元(不限时长,一台机器绑定硬件)
2026年07月22日
152 阅读
0 评论
0 点赞
2026-06-27
音频转字幕自动翻译一条龙
音频转字幕自动翻译一条龙更新集成了sensevoice-small模型删除了whisper-large-v3-turbo模型关于效率194分钟音频whisper-large-v3-turbo 114秒 输出字幕whisper-large-v3 408秒 自带英文字幕输出API常见的都有,包括两个本地的,以下截图不全一、软件简介本工具将文件夹内的音频/视频批量转成 SRT 字幕,可选 API 翻译或 Whisper 内置译英设置好API服务后,勾选API翻译时,转出字幕会自动翻译成你设置的目标语言,无需其他设置Whisper 内置译英,无需API设置即可直接将任意语言输出为英语字幕二、运行前准备硬件建议使用 NVIDIA 显卡(CUDA),转写速度明显快于 CPU。显存建议 ≥ 6GB(large 级模型量化版约 3GB/路)。授权首次启动会验证正式授权 license.key 或在线试用(全功能72小时试用)。试用/授权失败时,控制台会显示机器码,需联系我获取授权文件正式版费用说明:200元,在线限时长.350元,离线授权,断网可用启动方式双击傻木摄影.exe运行控制台出现 http://127.0.0.1:8765/ 后,浏览器会自动打开;三、界面操作(逐步说明)【第 1 步】选择音频文件夹在「音频文件夹」输入路径,或点「浏览…」选择。程序只处理该文件夹根目录下的文件,不递归子文件夹。支持格式:.mp3 .wav .m4a .flac .aac .ogg .wma .mkv .mp4【第 2 步】选择布局(右上角)自动:屏幕物理宽度 ≥ 2200px 居中显示,否则全屏标准:固定居中宽度满屏:界面横向铺满【第 3 步】选择模型在「模型选择」下拉框中选择(见第四节两个模型的区别)。【第 4 步】调整字幕参数(默认参数已最佳化,不建议调整)单条最长:每条字幕最长持续时间(默认 8 秒)单条最多:每条字幕最多字数(默认 35 字)数值越大,单条字幕越长、行数越少;越小则切分更碎。【第 5 步】翻译相关选项(可选,见第五节)右侧勾选区可配置 API 翻译、双语对照、Whisper 自翻等。【第 6 步】配置 API(需要翻译时)展开底部「API 设置」。填写对应平台的接口地址、API Key、默认模型。点「测试」,通过后自动打开「翻译可选」开关。启用后,该提供方会出现在右侧「翻译 API」下拉中。支持:硅基流动、火山、LM Studio、Ollama、DeepSeek、智谱、Moonshot、OpenAI 等。【第 7 步】开始转写点「开始转字幕」。可查看总进度 / 当前文件进度和运行日志。任务进行中,设置项会锁定,需等全部完成后才能更改。【第 8 步】查看结果字幕默认保存在音频同目录,文件名与音频一致。若有失败,文件夹内会生成「失败记录.txt」。若勾选了自动翻译,则会生成_en字幕或者_all字幕文件四、两个模型的区别与选用建议程序内置两个 opeai/Whisper 模型,路径均在 py/openai/ 下:对比项 Whisper large v3 turbo(默认) Whisper large v3模型 ID openai/whisper-large-v3-turbo openai/whisper-large-v3 速度 更快,适合大批量 相对较慢 转写质量 优秀,日常听书/播客推荐 长音频时间轴更稳 Whisper 原生译英 不支持(无翻译训练) 支持 「自翻」选项 不可用 可用 「仅英文」选项 不可用 可用 推荐场景 只要原语言字幕、追求速度 要中英双轨或 Whisper 译英【各自怎么用?】场景 A:只要原语言字幕(最常见)1. 选 Whisper large v3 turbo 2. 不勾选任何翻译选项 3. 开始转写 → 得到 文件名.srt 场景 B:要原语言 + 英文(Whisper 自己译)1. 选 Whisper large v3 2. 勾选「自翻」 3. (可选)勾选「中英」或「英中」生成对照字幕 4. 得到: - 文件名.srt(原语言) - 文件名.en.srt(英文) - 文件名_all.srt(双语对照,若勾选了中英/英中) 场景 C:只要英文字幕(Whisper 译英)1. 选 Whisper large v3 2. 勾选「仅英文」 3. 得到 文件名.srt(内容为英文) 场景 D:turbo 转写 + API 翻译任意语言1. 选 Whisper large v3 turbo(或 large v3 均可) 2. 勾选「API翻译」 3. 选好翻译 API、源语种、目标语种 4. 得到: - 文件名.srt(原语言) - 文件名.en.srt(或 文件名.目标语种代码.srt) - 文件名_all.srt(若勾选中英/英中) 五、翻译选项说明以下选项互斥,同时只能开一种主模式:选项 作用 适用模型API翻译 转写完成后,用 LLM API 翻译整份字幕 任意 中英 双语合并,源语种在上、译文在下 → *_all.srt 配合 API翻译 或 自翻 英中 双语合并,译文在上、源语种在下 → *_all.srt 同上 自翻 Whisper 先转写再译英,输出 .srt + .en.srt 仅 large v3 仅英文 Whisper 直接译英,只输出 .srt(英文) 仅 large v3源语种:选「自动」时由 Whisper 检测;也可手动指定(如中文音频选 zh)。六、输出文件一览以音频「播客第1集.mp3」为例:文件名.srt 主字幕(原语言,或「仅英文」时的英文字幕) 文件名.en.srt 英文字幕(自翻 / API 译英时) 文件名.zh.srt 等 API 翻译到其它语种时(扩展名为语种代码) 文件名_all.srt 双语对照(勾选中英/英中时) 失败记录.txt 批量任务中有失败项时生成 主角光环.txt 输入文件(可选,见下)七、进阶功能主角光环(同音字纠错)在音频文件夹内新建「主角光环.txt」,每行一个正确人名,例如: 张璐 李明转写时会自动把同音错字替换为正确名字。例如,某小说音频主角名称为张露模型转写时可能会随机出现张禄,张璐,章录,脏路等等同音字对于模型来说,这些都是对的,因此做了「主角光环.txt」本程序会自动纠偏,最终输出结果时会输出报告设置自动保存界面设置会写入 Sam.json(模型、文件夹、字幕参数、API 配置等),下次启动自动恢复。八、注意事项(重要)文件夹必须真实存在,且内含支持的音频文件。任务进行中不能切换模型、改路径或 API,需等待完成。仅扫描当前文件夹一层,子目录内音频不会被处理。turbo 不支持 Whisper 自翻/仅英文;需要这些功能必须切换到 large v3。API 翻译需先测试通过并开启「翻译可选」,否则下拉框无可用 API。授权与硬件绑定;更换主板/CPU/网卡可能导致授权失效,需重新申请。显存不足时可能报错或极慢;可关闭其它占 GPU 的程序后重试。如果事先知道音频时中文还是英文,应该在源语种选择好语种不限制音频时长,单音频16小时,5090 输出字幕时长约7分钟链接:https://pan.baidu.com/s/1eBMEm1nCUenbw6FYsst0nA?pwd=gpcb
2026年06月27日
339 阅读
1 评论
0 点赞
2026-06-13
今天可以放假吗
我们今天可以放假吗?我们似乎正处于全球白领劳动力(以及很大一部分美国劳动力)生产力革命的开端。人工智能将彻底改变我们的工作方式、与世界互动的方式、学习方式、社交方式等等。这听起来很棒,的确如此。一切都变得更快更便捷,对我们所有人来说都将是莫大的福音。效率提升带来的新命题那我们能放一天假吗?如果人工智能能够使我们的生产力全面提高 10 倍,那就意味着我应该能够在周一中午之前完成以前需要一整周才能完成的工作量。那我周五可以休息吗?从现在开始,我周一、周二、周三、周四上班,周五休息。我们甚至可以把周五定为“AI员工日”;我保证周四会拼命写出高质量的题目,然后周五经纪人就可以全天使用这些题目了。这样一来,你们周五也几乎没损失什么时间,对吧?当然,这适用于所有人。所以,各位董事会成员和高管们,你们周五可以休假去高尔夫球场打满18洞。想想都觉得美妙,不是吗?你们不用待在办公室,因为我也不在。你们不用待在办公室,因为人工智能代理在那里。我也不用!仅仅多一天而已。考虑到人类生产力各个领域发生的巨大变革,这似乎合情合理,而且确实只是一个很小的改变。(嘿,埃隆:我正在努力提高生育率。在加州,三个小孩的托儿费一个月要六千美元。我这周必须五天都去办公室吗?为什么不去四天?)核心逻辑探讨文章提出一个问题:AI 大大提高了白领工作的效率,以前一周的工作,现在几个小时就能完成,那么可以放假一天吗?这个建议完全是合理的逻辑。既然更少的时间完成了同样的工作,那么放假对公司并没有损失。反而,要是不放假,也不加薪,那么 AI 对员工的意义是什么?除了员工因为 AI 有了更多的工作技能和成果,我认为,一个可能的答案是:AI 提高了全社会的生产效率,这意味着长期中,所有工作岗位的平均薪资(或福利)是提高的。本文转载https://mlsu.io/posts/day-off/
2026年06月13日
117 阅读
0 评论
0 点赞
1
2
...
6
网站版权本人所有,你要有本事,盗版不究。 sam@gpcb.net
流式
卡片