基于物体检测及关系推理的视觉问答方法研究

来源 :测试技术学报 | 被引量 : 0次 | 上传用户:chuai09
下载到本地 , 更方便阅读
声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架
论文部分内容阅读
大多数图像描述及视觉问答任务中,主要工作是对图像数据的拟合分类,而缺乏图像中物体之间的关系推理,导致描述图像或回答问题时准确率不高.为解决该问题,本文提出一种基于物体检测及关系推理的视觉问答模型.该模型由上游网络和下游网络两部分组成,上游网络采用极快速区域卷积神经网络,下游网络由多层感知机组成的多模态特征融合推理网络构成.上游网络对图像进行物体检测与特征提取,利用长短期记忆网络对提问的问题进行信息提取以嵌入下游网络;下游网络对问题和图像的特征进行融合和推理,进而得出答案.采用数据集CLEVR进行模型
其他文献
本文,先将[1]P326的引理4.9和引理4.10的条件,用一个简单而又便于应用的等价条件来代替,得到用算子A的导算子A′_+(θ)及A′_+(∞)的谱半径ρ(A′_+(θ)),ρ(A′_+(∞))的值
本文就抗癌药物Taxol的化学成分,药理作用,临床等研究的历史,近况及其发展,予以综述。
改革开放初期,我国"三资"企业迅速发展,是"三资"企业劳资关系的形成时期。为改善"三资"企业劳资关系,调节"三资"企业劳动问题,国家非常重视对"三资"企业的劳动立法和劳动人事
<正> 本文记述了贵州省襀翅目(Plecoptera)l新种及贵州3新纪录种。新种模式标本保存在北京农业大学昆虫标本室。刺(虫责)科Styloperlidae 1.胡氏剌(虫責)Styloperla wui Chao
本文应用^Coγ射线辐照刺梨枝芽,经适宜剂量照射之后,提高了果实品质,其口感之酸、涩味均有所降低。本试验对改进刺梨果品质量有一定意义。
近年来我们整理中药资源普查采集的药用植物标本,对部分误定的标本进行了订正,从中发现贵州省地理分布新记录属2个(Aruncus Adans.,Gleadovia Gamble et Prain),新记录种和变
贵州柑桔介壳虫有32种,其天敌有52种,介壳虫与天敌中有12种为贵州新记录。本文还采用了植物学上的频度分析法研究了介壳虫及其天敌发生分布的特点。分析表明群落的多样性指数
兰坪县易地扶贫搬迁工作已进入到后续扶持阶段,虽然已实现"搬得出",但如何"稳得住、能致富"才是脱贫致富的关键所在。以可持续生计理论为依据,从五个方面研究兰坪县易地扶贫
报送重要紧急信息,中央办公厅、省委办公厅近几年来下发了一系列文件,就报送重要紧急信息范围、时限等都提出了明确规定和具体要求。笔者通过十几年的信息工作实践,积累了一
针对疫情下企事业单位复工,学校开学返校和公共场所人员流动等情况,以及人员进出门禁时所需进行的身份信息登记,测温消毒等繁琐的防疫检测问题,研究了一种智能消毒及预警门禁系统.研究包括:智能消毒及预警门禁系统模型的构建;人脸及身份证信息的采集和智能识别;消毒杀菌的协同处理策略;人员身份数据的网络通信和云端存储.采用非接触式热成像摄像机采集人体体温信息;构建基于卷积神经网络的宽度学习系统模型对人脸特征进行