一种基于图的关键词抽取方法与流程

文档序号:11950220阅读:来源:国知局
技术总结
本发明涉及一种基于图的关键词抽取方法,该方法包括以下步骤:对文本信息进行预处理,预处理包括分词处理、词性标注处理和命名实体识别处理;计算节点特征,以及计算词汇的统计关系和词汇的语义关系;根据节点特征计算节点权重,以及根据词汇的统计关系和词汇的语义关系计算边权重;根据节点权重和边权重计算候选词的分值;根据候选词的分值排序结果以及文本大小信息确定该文本的关键词。本发明提出的一种基于图的关键词抽取方法不需要标注语料,而且可以通过对TextRank算法基于候选词特征增加节点权重、基于词汇语义关系改进边权重可以以较低成本提高关键词抽取的准确率。

技术研发人员:王志娟;冯迎辉
受保护的技术使用者:中央民族大学
文档号码:201610530337
技术研发日:2016.07.06
技术公布日:2016.12.07

当前第3页1 2 3 
网友询问留言 已有0条留言
  • 还没有人留言评论。精彩留言会获得点赞!
1