典型文献
视觉-语言导航的研究进展与发展趋势
文献摘要:
视觉-语言导航是近年来出现并蓬勃发展的新兴研究方向,是视觉-语言交互前沿领域中的代表性研究任务之一,其目标是根据人类给出的语言指令基于环境视觉感知实现自主导航.首先介绍该任务的研究内容,分析其面临的跨模态语义对齐、语义理解与推理和模型泛化能力增强3个方面的问题与挑战,然后列举了常用的数据集和评价指标;再从模仿学习、强化学习、自监督学习以及其他方法4个方面对该任务的研究进展进行归纳与总结,并对代表性方法的效果进行对比分析;从连续环境导航和高级复杂指令理解与常识推理2个方面论述该任务当前研究的热点趋势;最后对三维空间的视觉-语言导航、模糊导航、环境交互导航等未来发展方向进行讨论与展望.
文献关键词:
视觉-语言导航;视觉-语言交互;跨模态语义对齐;行为决策
中图分类号:
作者姓名:
牛凯;王鹏
作者机构:
西北工业大学计算机学院 西安 710129
文献出处:
引用格式:
[1]牛凯;王鹏-.视觉-语言导航的研究进展与发展趋势)[J].计算机辅助设计与图形学学报,2022(12):1815-1827
A类:
跨模态语义对齐,指令理解
B类:
前沿领域,研究任务,视觉感知,自主导航,语义理解,模型泛化,泛化能力,问题与挑战,模仿学习,强化学习,自监督学习,其他方法,常识推理,务当,热点趋势,三维空间,行为决策
AB值:
0.306203
相似文献
机标中图分类号,由域田数据科技根据网络公开资料自动分析生成,仅供学习研究参考。