期刊专题

文本相似度计算方法研究综述

引用
[目的]分析文本相似度计算方法,了解该领域的发展态势.[文献范围]在CNKI和Web of Science中分别以检索式“篇名:文本相似度OR篇名:词汇相似度OR篇名:语义相似度”和“TI:‘text similarity’or'semantic similarity,or'lexical similarity””并限定文献类型进行检索,最终得到69篇重点文献.[方法]对文本相似度计算方法进行系统梳理,分析重点方法的基本思想、特点并总结未来发展方向.[结果]形成了较为全面的分类描述体系,文本相似度计算方法可分为4类:基于字符串的方法、基于语料库的方法、基于世界知识的方法和其他方法.其中,基于神经网络和基于世界知识的方法以及针对跨领域文本的相似度计算将成为该领域的发展趋势.[局限]仅将不同方法本身作为探讨的核心,未进一步分析方法的应用情况.[结论]有助于全面把握和深入了解文本相似度计算方法的研究现状和未来趋势.

文本相似度、语义相似度、本体、词袋模型、神经网络

TP391;G35(计算技术、计算机技术)

2017-10-20(万方平台首次上网日期,不代表论文的发表时间)

共11页

1-11

暂无封面信息
查看本期封面目录

数据分析与知识发现

1003-3513

11-2856/G2

2017,(6)

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn