期刊专题

10.3969/j.issn.1007-5321.2009.05.003

中文高频词串的抽取及其在语言模型中的应用

引用
为准确抽取语料库中的高频词串,使其能更好地应用于语言模型中,提出了一种基于字串切分度的中文高频词串(CFS)抽取算法,并用该算法抽取出的CFS分别建立一元和二元语言模型.实验表明,基于CFS的语言模型能有效克服现有基于字和词的n元语法模型长距离相依性能较差的缺陷;同时,在模型困惑度、音字转换正确率上均优于已有基于净频次的CFS语言模型.

中文高频词串、字区分度、字串切分度、n元模型、音字转换

32

TP391.1(计算技术、计算机技术)

国家科技支撑计划项目2007BAH05B02-04;高等学校学科创新引智计划项目B08004;BUPT-Nokia合作项目

2009-12-22(万方平台首次上网日期,不代表论文的发表时间)

共5页

10-14

相关文献
评论
暂无封面信息
查看本期封面目录

北京邮电大学学报

1007-5321

11-3570/TN

32

2009,32(5)

相关作者
相关机构

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn