大数跨境

混合智能架构工业视觉检测Agent、传统工业视觉检测和工业视觉检测算法

混合智能架构工业视觉检测Agent、传统工业视觉检测和工业视觉检测算法 锐英源软件
2026-08-21
2
导读:检测技术方向混合智能架构工业视觉检测AgentLiquid Quality Agent把大模型应用于质检方向,而锐英源软件要实现的是检测技术方向混合智能架构工业视觉检测,实现“确定性算子+大模型”结合
众为兴机械臂配合的传统工业视觉检测

锐英源软件是众为兴业务合作伙伴,这里用众为兴的产品对传统工业视觉检测成果进行描述。众为兴的机器人已经应用于晶圆加工,技术先进。左图是众为兴笔记本键盘加工视觉产品的设计后台的截图。

用后台截图,说明传统工业视觉检测是用固定模式把检测场景和检测产品先进行了数字化抽象,检测场景里也包含了流程,检测产品在流程约束下,获取结果,指导机械和生产线生产运行。

在众为兴笔记本键盘加工视觉产品里有对键盘大小和键盘上一个键区域大小的严格定义,按照这个定义,才能进行精密定位,放入指定位置。

谈到场景和流程,锐英源软件对3D数据AI大模型控制下修改操作记忆犹新,AI大模型能够记忆住一个3D场景的三维坐标结构,实体比如一个窗户移动到另外一个墙上,AI大模型能够给出正确的位置,窗户在新位置能够正确渲染。所以传统工业视觉检测的很多工作能被AI大模型代替,传统工业视觉检测厂家如何结合AI进行创新,是未来的生存之道。


小型的视觉检测台

这是配置相机和传动装置的小型视觉检测台,能够检测小型配件,检测出外观、产品外径、内径、高度、污渍和区分方向等等,配件有O形圈等等。

中国是全产业链国家,各类配件繁多,在配件的生产、质检和消费使用场合,需要大量的视觉检测活动

如果按传统工业视觉检测模式,为配件建立硬件和软件体系,投入非常大,锐英源软件通过对手机拍摄图片结合AI大模型识别的长期开发过程,建立了算法评估能力。工业视觉检测算法是视觉检测的核心,对算法评估有成果,会对后续是否进行生产线投资有重大指导意义,对于不能完成的项目不投资,保证资金流水,会让企业更好的面对困难。有了工业视觉检测算法,可以围绕算法建立一系列的仿真软件或平台,也会降低硬件投资成本。

锐英源软件对于图片识别大模型的使用非常精通,因为对手机图片进行研究找对应的代码来解析手机图片,这些代码其实就是流程。如果厂家需要图片大模型定制提示词识别方案,请联系锐英源软件。

现在图片识别大模型有提示词功能,比如:。

商汤大模型的提示词模式,就像给了你一套强大的“导演工具箱”,让你能精准地发号施令:

  1. 超级“剧本”(超长指令遵循):你的“导演指令”可以非常复杂。商汤的模型(如SenseNova U1.5 Lite)能原生支持长达3-4k字符的提示词,足以容纳对主体、数量、空间关系、风格、文字等多重约束的详细描述,避免了因指令过长导致模型“崩溃”或遗漏细节的问题。

  2. 精准“调度”(精细视觉控制):你可以精确指定AI的关注区域。例如,通过边界框(Bounding Box) 或视觉标记(Visual Marker) 来框选图中的特定物体或区域,让AI只针对该部分进行操作。

  3. 下达“具体任务”(任务与输出定义):你可以明确告诉AI要完成什么任务以及如何输出结果。

    • 结构化输出:要求模型输出文本格式的坐标与标签,例如识别图中所有的“牛”,并返回它们的位置框。

    • 密集输出:要求模型生成图像,例如分割遮罩、深度图等。

    • 混合输出:结合以上两种,完成更复杂的任务。

  4. 巧用“范例”(少样本学习):你可以在提示词中给AI看几个“输入-输出”的例子(比如几张标注好的图片),它能快速理解你的意图和标准,然后处理新的同类任务。

Liquid Quality Agent

Liquid Quality Agent把大模型作为数据评判的法官,用SQLite证据链、LangGraph Agent和RAG质量规范等等技术,保存历史数据,分析新数据,给出可信赖的评判结果。

SQLite证据链、LangGraph Agent和RAG质量规范等等技术是随着AI大模型开发而成熟的技术,绝对不是5年前传统软件形式可以定义的技术,以前的软件一般是保存,传统的查询,生成一些报表,数值价值上非常低。

Liquid Quality Agent是开源项目代码,源代码可以下载下来学习,锐英源软件会对里面的源代码进行研究分析,公之与众,欢迎大家关注。


检测技术方向混合智能架构工业视觉检测Agent

Liquid Quality Agent把大模型应用于质检方向,而锐英源软件要实现的是检测技术方向混合智能架构工业视觉检测,实现“确定性算子+大模型”结合,达到“可落地的混合AI(Hybrid AI for Industrial)”效果。

简单理解来讲,用多非AI大模型和多AI大模型结合,AI大模型的通用性和可迭代性强于非AI大模型普通代码,而非AI大模型普通代码在现场性和价格优势上明显,锐英源软件可以灵活调度这两类模式,也可以现场部署图片识别AI大模型,离线使用图片识别大模型,对于非AI大模型普通代码的成果也可以投入AI大模型的训练,让AI大模型进化,同时在非AI大模型代码的局部也可以使用AI大模型来识别,达到优中选优的效果。

把大图片拆开成几个局部小图片,再进行识别,锐英源软件在手机图片识别上已经实现了,配合锐英源软件强大的开源产业化经验,对于可落地的混合AI(Hybrid AI for Industrial)实现,对于混合智能架构工业视觉检测Agent的实现,锐英源软件信心十足。

手机摄像头照片检测结果实例

这是对牛进行随意拍照图片,正常检测出了圆心纹理,平行纹理,对于中间部位的垂直走向的部分的垂直特征也可以检测出来。这些部分有坐标,有大小,有类型,通过这些属性可以区分不同的牛。

毛发是最难识别的纹理,毛发难关过了,其它的纹理检测都能开发出来。

算法开发思路需要人来思考,AI没有这方面的能力,这类经验高度是AI和新手达不到的。

欢迎各类高校、科研院所、企业技术中心和视觉检测业内朋友,在数据处理上,和锐英源软件进行积极洽谈,时间就是金钱,项目按时完成才是目标。



【声明】内容源于网络
0
0
锐英源软件
1234
内容 43
粉丝 0
锐英源软件 1234
总阅读32
粉丝0
内容43