基于流形子空间学习的领域自适应方法研究

来源 :武汉科技大学 | 被引量 : 0次 | 上传用户:HalfHour
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
传统机器学习方法只有在训练数据和测试数据满足相同分布时表现出良好的效果。在现实场景中,训练数据往往与测试数据分布不同,从而导致分类准确率降低。
  在领域自适应问题中,将训练数据作为源域;而将测试数据作为目标域。其目的是减少源域和目标域之间的分布差异。本文提出两种基于流形子空间学习的领域自适应方法,用流形学习的方法将源域和目标域映射到同一子空间中去。在这个子空间中,源域数据和且标域数据有着相似的分布。本文的主要研究内容如下:
  (1)为了衡量源域样本集与目标域样本集之间的分布差异,本文提出一种跨域均值差异(Cross-Domain Mean Discrepancy, CDMD)的度量准则,进而提出一种基于半监督判别分析和跨域均值差异的领域自适应方法(SDA-CDMD)。首先,使用半监督判别分析(SDA)进行数据降维,保证了映射到低维子空间中数据的几何结构信息。然后将SDA与CDMD结合,将两个域投影到同一子空间中,减少两个域之间分布差异的同时保留了原始样本的流形结构。在手写数字图像和计算机视觉数据集上进行的大量实验结果表明,所提算法优于传统的领域自适应方法,验证了其有效性。
  (2)提出一种基于有监督局部保留投影和最大均值差异的领域自适应方法(SLPP-MMD)。该方法将有监督保留投影与MMD相结合,将源域和目标域投影到同一子空间中去。在迭代过程中为了避免将错误标注的伪标签目标域样本传播到下一次迭代训练,从而影响子空间的学习过程。本文提出一种新的伪标签样本选择方案和迭代策略。在与JDA算法的对比实验中,本文方法具有更好的收敛性能。同时,算法分类效果优于传统的领域自适应方法。
其他文献
学位
学位
学位
机器阅读理解是自然语言处理领域的一颗明珠,同时也是该领域的研究焦点。机器阅读理解技术可以广泛应用于语音助手、智能客服、聊天机器人等领域。近年来,得益于大数据和深度学习技术的兴起,机器阅读理解获得了广泛的关注。在传统的工作中,主要采用基于规则和基于深度学习的方法。其中,基于深度学习的方法对问题和上下文分别进行编码得到向量表示,然后利用注意力机制使得两者进行交互,最后利用交互的语义信息预测答案的开始和
目标检测是计算机视觉领域的重要方向,随着深度学习方法及相关硬件设备的发展,它在自动驾驶、智能监控、智能手机等方面都有着广泛的应用,具有重要的研究意义。  基于无锚框深度学习的目标检测是一种主流的单阶段目标检测算法。融合多层监督信息的沙漏网络结构能够显著提升无锚框目标检测算法的精度,然而其速度却远低于同层次的普通网络的速度,并且不同尺度目标间的特征会互相干扰。针对上述问题,本文提出了一种非对称沙漏网
学位
测量胎儿头围可估计胎龄和监测胎儿的生长。医学超声影像技术由于其廉价性、无辐射和实时性,成为测量胎儿头围的首选方式。然而,目前的主要测量方式是通过有经验的医师手动测量,测量精度依赖于医师临床经验。这种方式易导致超声图像测量耗时,增大医师工作量。现有有经验的医师资源并不充足,一些落后地区更为明显,影响孕妇产前检查的准确性。为了提高超声测量的工作效率以及准确性,本文提出一种测量方案帮助解决自动测量胎儿头
行人重识别是指在跨摄像头的场景下进行行人的匹配。它是计算机视觉中的热门研究领域之一。在实际应用场景中,摄像机拍摄角度的变化、身体部件被拍摄场景中物体遮挡以及行人姿态存在多变性等问题使得行人在检测框内的空间上不对齐,这给行人重识别的特征提取阶段带来了极大的挑战性。因此,如何在跨视角场景下获取具有高判别力的特征是行人重识别的研究重点。针对以上问题,本文提出了基于密集3D部件对齐的行人重识别方法研究。具
在大量实际问题中,往往存在不止一个全局最优解和多个局部极值解,如何构造一种优化算法,使之能够求出所有全局最优解和尽可能多的局部最优解,这类问题就称作多模态优化问题或多峰函数优化问题。而多模态优化问题又可以分为多模态单目标优化问题和多模态多目标优化问题。烟花算法是最近才提出一种群体智能算法,可以用来求解很多实际的优化问题,具有很好的局部搜索能力。但是近年来烟花算法还没有被应用到求解多模态优化问题上。