主权项 |
一种邻域高斯结构和视频特征融合的动作识别方法,其特征在于,具体步骤为:步骤1、构建无背景多尺度模板,具体是:首先将模板图片转成灰度图,之后将图片的背景去除,最后对其进行缩放处理;步骤2、对步骤1得到的多尺度模板进行3D LARK特征提取,之后对提取出的3D LARK特征进行去冗余处理;步骤3、对步骤2得到的特征向量矩阵W<sub>Q</sub>邻域窗口内的数据进行高斯拟合,之后对高斯拟合后的结果进行去冗余处理;步骤4、将待测视频转换为灰度视频,然后提取显著区域,之后再提取显著区域内像素点的3D LARK特征,最后进行单个向量去冗余处理;步骤5、将待测视频3D LARK特征集F<sub>T</sub>邻域9×9窗口内的数据进行高斯多维拟合,之后对高斯多维拟合后的结果进行去冗余处理,得到:<img file="FDA0001075136310000011.GIF" wi="278" he="69" />R为实数域,m<sub>2</sub>为9×9窗口遍历待测视频后的循环次数;步骤6、对3D LARK特征和邻域高斯结构特征的模板与待测视频进行局部匹配,并记录向量位置信息;步骤7、对向量位置信息进行统计,具体是确定统计窗口内不重复的索引值个数,分别得到目标存在的统计概率矩阵T<sub>3DLK</sub>和T<sub>NRFM</sub>;步骤8、将统计概率矩阵T<sub>3DLK</sub>和T<sub>NRFM</sub>相乘融合得到最终的统计概率矩阵T<sub>final</sub>,在最终的统计概率矩阵T<sub>final</sub>中用非极大值抑制的方法,逐帧提取出目标动作。 |