首站-论文投稿智能助手
典型文献
面向未登录词及多义词的共现性词嵌入改进
文献摘要:
基于语料库构建词语语义性向量的词嵌入模型,可以定量刻画词语的上下文语义.然而,传统的词嵌入模型在揭示一词多义词汇的语义时,存在着语义空间向量维度不确定或缺乏直观可解释性等局限,此外,对于词汇表外未登录新词语的语义性嵌入识别,尚缺乏有效的途径.针对一词多义问题和未登录词问题,可将词嵌入的优势和词共现的优势相融合,以弥补传统词嵌入模型的语义空间维度不确定、语义维度不可解释及未登录词忽略等方面的不足.主要创新工作包括:基于训练后的词嵌入矩阵与单词归一化的共现矩阵,构建全局性语料词向量;为未登录词创建语料词向量,并与全局性语料词向量进行权重融合,以提高词嵌入的精确率.通过公开数据集的两项实验结果表明,基于词共现的一词多义及未登录词嵌入模型,可有效提升词嵌入的精确度,并可缩短词嵌入的进程时间.
文献关键词:
词嵌入;未登录词;多义词;共现矩阵;词向量
作者姓名:
李保珍;顾秀莲
作者机构:
南京审计大学 信息工程学院,江苏 南京 211815
引用格式:
[1]李保珍;顾秀莲-.面向未登录词及多义词的共现性词嵌入改进)[J].计算机技术与发展,2022(12):117-122
A类:
B类:
未登录词,多义词,基于语料库,语料库构建,语语,性向,词嵌入模型,以定,定量刻画,上下文语义,一词多义,语义空间,空间向量,向量维度,可解释性,词汇表,新词语,尚缺,词共现,空间维度,语义维度,创新工作,工作包,单词,共现矩阵,全局性,词向量,行权,权重融合,精确率,公开数据集
AB值:
0.283912
相似文献
机标中图分类号,由域田数据科技根据网络公开资料自动分析生成,仅供学习研究参考。