今天是葉子日更第975天。

哈喽大家好!我是葉子。
手机相机拍的、网上下载的、微信保存的的各种图片,一年一年的堆在电脑里面。
等想要找的时候,看着一堆命名是几乎是乱码的图片,头直接大一圈。
而且很多比较私密的图片,上传到网盘里面,又太不放心。
以上这些问题我全都有。
所以我决定手搓一个工具,帮我把这些照片批量打标签+改名。
就是前几天文章里面说的那个,我今天终于搞定了。
下面分享给大家使用教程。
一、工具的优缺点,和适合人群
优点:
1、免费,本地运行,不用上传。
2、可以上万张批量打标签+改名。
3、一次没搞定,下次打开可以断点继续。
4、AI 自动识别,打开后自动挂机即可。
缺点:
1、比较耗费时间。根据不同的下载模型,单张十几秒到几十秒不等。
2、对电脑有一点要求。
-
系统:Windows 10 / 11(64 位) -
内存:8 GB 以上,推荐 16 GB -
显卡:Intel / AMD / NVIDIA 都行,集成显卡也能跑(慢一点) -
硬盘:至少留出 5 GB 空间放模型
适合人群:
1、电脑里面图片太多,太乱。
2、不想上传到网上云处理的。
二、使用流程
这个工具和之前的几个不一样,不能直接打开即用,需要下载到本地。
源码仓库地址:
https://github.com/huimengshiyezi/img-desc-renamer
绿色包直接下载地址:
https://github.com/huimengshiyezi/img-desc-renamer/releases/download/v1.0/img-desc-renamer-portable-win64.zip
下载完需要解压一下。
记得先打开看看使用说明。
因为是整合包,直接双击启动文件就可以开始使用了。
打开后根据提示操作,第一次打开会自动下载模型(3GB左右),需要一些时间。
模型就位后,会自动打开浏览器界面。
最后输入你图片放置的地址,一键点击就会开始识别了。
每次开始后需要几十秒的模型启动时间。
用起来还是比较简单的。
PS: 图片越多花的时间越长,大模型识别一张需要 15秒左右,建议可以根据图片数量大概估算个时间晚上挂机跑。
觉得模型下载比较慢的,也可以自行下载放在对应位置。
一共两个模型,一个是阿里的识别图片的模型,一个是模型对应的视觉编码器。
Qwen3-VL-4B 模型(2 个文件)下载完放在 models/qwen3-vl/ 文件夹里面即可。
README 里面把对应模型的下载链接都写好了,直接照着下载即可。
三、创建工具的一点个人经验
1、关于模型
我一开始想的是用 WD 标签识别器。就是当年用 SD 倒推图片提示词的打标模型。但是实测下来感觉不太行。
后来找了阿里的 Qwen 模型。找了其中一个合适的。
当然我是碍于自己电脑的配置。电脑配置更好的可以根据 用更强大的模型。
不过目前用的 对于识别图片基本足够了,而且耗时最短。
2、关于流程
当前版本一共迭代了至少 8 次,每实测一次,就会觉得有流程复杂或多余,就直接让 AI 继续改。
后面我自己用着没问题了,但是要让大家都可以用,就又加了不少流程。
比如模型的替换,以及下载模型的步骤,不能改代码,要直接在网页上选择等等。
直到最后改成一个整合包,直接点击即用。
写在最后
我最近一共做了四个工具,都免费分享给大家了。
这个工具目前最复杂,花的时间也最长。
我最大的感觉就是前期 AI 做的方案和工具再好。也赶不上后面的实测。
几乎每次测试,都会意识到有需要优化的地方。
说白了,工具好不好用,还是得用了才知道。
而且,你得首先对这个工具有一个概念,想要完成怎么样的功能,这个确实挺重要的。
最后还是欢迎大家使用。
有什么建议,都可以留言告诉我。感谢。
以上。
今天的文章就到这里,如果觉得不错,请随手点赞、比心、转发三连吧。
如果想第一时间收到推送,也可以点击一下关注和星标⭐。
我们,明天见。

