一种基于稠密语义相似度的图像部件分割方法及系统

123技术园

首页 / 技术内容

2025-02-22 12:27

No.1342835318407307264

技术概要

PDF全文

本技术公开了一种基于稠密语义相似度的图像部件分割方法及系统，包括以下步骤:收集图像数据，将收集的图像数据作为基础图像数据集的数据；使用目标框选定目标图像中的物体；分别提取目标图像以及基础图像数据集的图像特征，得到图像的全局特征与描述子；计算每个目标图像全局特征与所有基础图像全局特征的稠密语义特征相似度，获得最相似基础图像；计算目标图像描述子与最相似基础图像的基础图像描述子稠密语义特征相似度，获取基础图像物体与目标物体之间部件的相似度，并根据相似度分割目标物体的部件。本发明对未见过的物体进行部件分割，提高物体部件语义分割的效果，降低对数据集的需求，有广泛的应用价值用。

背景技术

随着互联网技术的发展和智能数码产品的普及，在生活生产中的图像数量急剧增长，人们需要对不断出现的图像进行分析来满足现实生活中的需求。在机器人控制、图像编辑、图像生成应用中，仅仅进行对象级别的感知是不够的，还需对物体的部件进行分割。部件分割是对物体的进一步解析，有助于提升机器人的环境感知能力，促进图像的精密化处理。部件分割的能力依赖于训练集中图像的数量与部件的种类。然而，目前公开的部件数据集的图像数量不足且种类单一，现实世界中的物体与部件的数量与种类远远超过目前公开数据，这极大的限制了部件分割模型对于训练集中未见过物体的部件的分割能力。因此，近些年来随着人工智能技术的发展，为未见过物体的部件分割的提供了一些新的可能，期待一种基于稠密语义相似度的图像部件分割方法。在目标抓取、图像编辑、图像生成应用中仅仅进行对象级别的感知是不够的，还需对目标的部件进行识别。目前部件分割的数据集的种类和数量有限，因此限制了部件分割技术的发展。相较于部件级别的数据，目前对象级的数据量与种类丰富，因此现有技术大多在对象级别的任务下开展研究。部件分割不仅与部件标注的数据量与种类相关还与部件所属的物体类别密不可分，即同一标注的部件在不同物体上的形态和颜色各异，比如部件标注是耳朵，但是猫的耳朵与兔子的耳朵在形态和颜色存在明显差异，这使得部件分割更具挑战性。在部件分割任务中，大多都是依赖于有监督的学习方式，然而数据集严重约束了这种方法的分割效果。之后，随着多模态模型的发展，利用文本特征辅助图像进行部件分割，这种方法在一定程度大大提高了部件分割的效果，但是需要增加文本特征的计算量。此外，一些研究通过构造伪标签与多模态结合的方法进行部件分割，这种方法在数据集中出现的部件类别分割效果较好，但是在数据集未见过的类别处理效果较差。现有技术采用两种方案（一阶段和二阶段）进行部件语义分割（OV-PARTS:Towards Open-Vocabulary Part Segmentation）。二阶段方案采用ZSeg+模型，一阶段方案采用CLIPSeg模型，这两种模型均需要与文本特征相结合。ZSeg+模型需要先生成感兴趣区域，之后利用文本特征与感兴趣区域进行分类与掩码。CLIPSeg模型利用图像编码器生成图像特征，利用文本编码器生成文本特征，融合文本与图像特征，利用解码器生成图像掩码与类别。以上两种方法都需要文本特征，对数据集要求更高。在进行未见过物体部件分割时，依赖于模型的好坏与文本特征，而部件数据集的数量与种类有限，因此基于部件数据集训练出的模型的泛化能力较弱。针对现有技术中部件数据集涵盖的物体种类较少，带有部件掩码的图像数量不足，并且部件标注的成本较高等问题，提出种基于稠密语义相似度的图像部件分割方法对未见过物体进行部件分割，不受数据集中图像数量与物体类别的限制。在未见过物体分割任务中，现有技术常采用开放词汇技术进行语义分割，而该方法使用的数据集不仅需要大量带有部件掩码的图像还需要对应文本标注，而同一物体可以采用不同的文本描述，进一步增加了这种方法的难度。为解决上述问题，本方法采用图像的稠密语义相似度特征进行未见过物体的部件分割。

实现思路

阅读余下40%

技术概要为部分技术内容，查看PDF获取完整资料

该技术已申请专利，如用于商业用途，请联系技术所有人！

技术研发人员：

杨姗魏武

技术所属：华南理工大学

相关技术

变压器呼吸器变色检测方法、装置、系统及电子设备  变压器呼吸器变色检测方法、装置、系统及电子设备 
 本发明实施例提出一种变压器呼吸器检测方法、装置、系统及电子设备，属于图像检测领域。方法包括:检测出待测的变压器呼吸器的原始图像中的硅胶框，得到硅胶图像；利用像素检测模型对硅胶图像进行逐像素检测，得到与硅胶图像的像素点一一对应的多个像素检测结果；依据多个像素检测结果，获得硅胶图像的检测特征值，进而依据检测特征值，获得变压器呼吸器的变色检测结果。如此，先检测出原始图像中的硅胶框，并逐像素地进行局部细致检测，从而能够检测出硅胶区域(即硅胶框内)的每个像素点是否变色，同时排除了非硅胶区域的干扰，大大提高了检测精度，从而提高了变压器呼吸器的变色检测结果的正确率。
基于机器视觉和AR的虫害检测与管理系统  基于机器视觉和AR的虫害检测与管理系统 
 本发明属于图像处理技术领域，具体涉及基于机器视觉和AR的虫害检测与管理系统。所述系统包括:图像获取部分，用于获取目标农作物的超分辨率图像和光谱图像；对超分辨率图像和光谱图像分别进行图像预处理；图像区域提取部分，用于从预处理超分辨率图像中识别出目标农作物的叶片区域和茎秆区域；虫害判断部分，用于对光谱图像中的叶片区域和茎秆区域进行光谱分析；虫害分析部分，用于在判断结果为真的情况下，从预处理超分辨率图像中叶片区域；AR显示部分，用于在AR设备中显示目标农作物的病虫害区域。本发明实现了对农作物病虫害的自动识别和实时监测。结合先进的图像处理和机器学习算法，能够快速准确地提取特征、分析病虫害情况。
一种电路板的故障快速检测方法、系统及存储介质  一种电路板的故障快速检测方法、系统及存储介质 
 本发明公开了一种电路板的故障快速检测方法、系统及存储介质，涉及电路板的技术领域，其中视觉检测模块通过红外摄像头捕捉电路板图像，并利用图像处理技术划分检测区域，识别钻孔程度和判断通过孔是否偏离，从而进一步分析通过孔偏离对电路板性能造成的影响，信息采集模块对孔内壁进行检测和记录，获取相关残留材料信息，同时监测电路板的性能变化信息和热分布状态信息，为后续的故障综合分析提供全面的数据支持；故障综合分析模块对数据检测集进行特征提取，并通过训练后的故障检测模型计算得到故障评估指数Gpzs，实现对电路板故障的综合评估和分析，通过对故障评估指数Gpzs与故障阈值W进行对比分析，得出故障评分报告，采取相应的分拣作业。
遥感影像检测方法、装置、电子设备及存储介质  遥感影像检测方法、装置、电子设备及存储介质 
 本发明提出一种遥感影像检测方法、装置、电子设备及存储介质，属于图像处理领域，解决了现有的遥感影像目标检测的检测速度慢、准确率低的问题。方法包括:对遥感图像进行裁剪，得到多张待测图像；针对每张待测图像，采用预先训练的目标检测模型，得到待测图像中的目标框；依据待测图像对应的裁剪位置，将带有目标检测结果的各待测图像进行拼接，得到已测图像；对已测图像中的目标框去重，得到遥感图像的检测结果。本发明减小了模型处理单张图像时的数据量，缩短检测时长，且通过模型检测和目标框去重，排除掉了更多的外部干扰，从而提高检测速度和准确度。
一种基于在网计算的流表压缩方法  一种基于在网计算的流表压缩方法 
 本发明公开了一种基于在网计算的流表压缩方法，属于软件定义网络技术领域。针对在软件端侧聚合方法的不足和软件端侧处理流量能力不足的问题，通过1.设置并初始化流表规则，经过二叉树结构分解成互不重叠的规则；2.将互不重叠的规则压缩成可以进行算术运算的表达式规则，并将表达式规则部署在网络可编程交换机；3.在该网络可编程交换机内利用表达式规则匹配网络流量，并依照表达式规则的动作字段转发网络流量到相应的目的地址。本发明利用网络可编程交换机的算术计算功能，和软件侧压缩的表达式流表，实现网络处理大规模流量并转发的功能，减少了网络可编程交换机存储的流表数量，有效降低存储开销，提高了网络通信效率。
一种基于分段信道估计的通感一体化系统干扰消除方法  一种基于分段信道估计的通感一体化系统干扰消除方法 
 本发明公开了一种基于分段信道估计的通感一体化系统干扰消除方法，步骤为:建立无蜂窝协作通感一体化系统的信道模型和数据传输模型，通过所有用户发送上行导频，中央处理器CPU估计出用户与接入节点AP之间的数据传输信道；通过所有下行接入节点AP发送目标检测信号，所有上行接入节点AP联合接收信号，中央处理器CPU检测感知目标是否在场景中；通过所有下行接入节点AP发送下行导频，中央处理器CPU得到接入节点AP之间的交叉链路干扰信道的估计；系统同时进行上下行通信和对目标移动方向和速度的感知，并基于信道估计结果，对接受到的通信和感知信号分别进行干扰消除处理。本发明能够有效地直接抑制系统干扰，提升通信和感知性能。
一种基于上半身姿态的驾驶员情绪状态检测方法及系统  一种基于上半身姿态的驾驶员情绪状态检测方法及系统 
 本发明公开了一种基于上半身姿态的驾驶员情绪状态检测方法及系统，涉及计算机视觉技术领域，包括:基于预设人体姿态估计模型识别待检测驾驶员的上半身视频片段中的人体关键部位，得到各关节位置的时间序列；对关节位置时间序列进行预处理，转化成关节流数据和骨骼流数据；分别将关节流和骨骼流数据输入到多个经过训练之后的图卷积神经网络模型，得到多个分类结果；基于集成学习方法融合多个分类结果，得到待检测驾驶员的情绪状态识别结果。本发明缓解了现有技术中存在的在驾驶环境下的动作情绪识别准确率较差的技术问题。
一种引入RBU的轻量化皮革表面缺陷显著目标检测方法  一种引入RBU的轻量化皮革表面缺陷显著目标检测方法 
 本发明提出一种引入RBU的轻量化皮革表面缺陷显著目标检测方法，获取皮革表面图像，对其进行预处理；利用模型RBU＆lt;supgt;2＆lt;/supgt;Net对预处理后的图像进行目标检测。本发明提出残差瓶颈U型块作为特征提取单元，融合了深度可分离卷积和通道注意力的性能优势，在一定程度上解决了工业生产线上的自动化皮革缺陷检测存在计算设备受限的困境。通过在模型中引入临近特征增强模块，强化模型对于多尺度特征的融合能力，优化目前在皮革检测领域无法准确刻画缺陷形状的情况。另外，还引入像素混合采样提高了特征信息利用率，增强模型的空间感知能力，使其在检测具有种类繁多、缺陷形状无规则、尺度变化范围大等皮革表面缺陷时，提升皮革检测的精确度。
一种基于金字塔的SAR图像相干斑抑制方法  一种基于金字塔的SAR图像相干斑抑制方法 
 本发明给出一种基于金字塔的SAR图像相干斑抑制方法。首先，将四种不同的残差模块级联成的残差块加到噪声估计的阶段，可以更充分地利用不同深度的残差模块对特征信息的提取，来促进学习过程；然后，采样多尺度的特征信息得到一个五级金字塔，可充分利用不同尺度的感受野以提取到多样化的、不同尺度空间的特征信息；最后，利用得到的多尺度特征信息进行融合、去噪，得到去噪后的图像，上下文信息对去噪后的图像保留细节信息有帮助。本发明利用四种不同的残差模块级联成的残差块和基于金字塔的思维对SAR图像进行多尺度特征提取、融合和去噪，实现了对真实SAR图像的去噪，并有效地保留图像去噪后的细节特征，显现了优异的去噪性能，具有广泛的适用性。
一种考虑多层级特征的多类别点云异常检测方法及系统  一种考虑多层级特征的多类别点云异常检测方法及系统 
 本发明属于三维检测相关技术领域，其公开了一种考虑多层级特征的多类别点云异常检测方法及系统，方法包括:提取训练用点云数据的多维特征，获得局部特征和全局特征；对全局特征进行聚类获得多个聚类中心，组成类别记忆库；在类别记忆库中获得与每个训练用点云数据的全局特征距离最近的聚类中心作为该目标聚类中心，提取集合的核心集作为子记忆库；利用待测点云数据的全局特征获得对应的目标子记忆库，而后利用待测点云数据的局部特征在目标子记忆库中查找距离最近的目标特征；计算待测点云数据的局部特征与目标特征之间的距离获得异常分数，依据异常分数判断待测点云数据的异常情况。本申请解决了多类数据相似导致的特征混淆问题的技术问题。

技术分类

电信、广播电视和卫星传输服务电信、广播电视和卫星传输服务

互联网软件服务互联网软件服务

集成电路设计集成电路设计

信息集成数字服务信息集成数字服务

电气机械制造电气机械制造

计算机、通信、电子设备制造计算机、通信、电子设备制造

医药制造、生物基材料医药制造、生物基材料

石油煤矿化学用品加工石油煤矿化学用品加工

化学原料制品加工化学原料制品加工

非金属矿物加工非金属矿物加工

金属制品加工金属制品加工

专用设备制造专用设备制造

通用设备制造通用设备制造

通用零部件制造通用零部件制造

汽车制造业汽车制造业

铁路、船舶、航天设备制造铁路、船舶、航天设备制造

电力、热力生产和供应电力、热力生产和供应

燃气生产和供应燃气生产和供应

水生产和供应水生产和供应

房屋建筑、土木工程房屋建筑、土木工程

交通运输、仓储和邮政交通运输、仓储和邮政

农、林、牧、渔业农、林、牧、渔业

采矿业采矿业

农副、食品加工农副、食品加工

烟草、酒水加工烟草、酒水加工

纺织皮具居家制品纺织皮具居家制品

文教体娱加工文教体娱加工