技术特征:
技术总结
本发明公开了一种基于n‑gram模型的简历解析方法,该方法为:预先收集简历样本,将常用字段关键词划分为不同类别形成分类词典,采用n‑gram模型统计出每一常用字段关键词转变到各样本关联词的转移概率,查找待解析简历中与常用字段关键词相匹配的目标关键词,如果目标关键词对应的转移概率大于预定阈值,根据目标关键词更新每一常用字段关键词对应的转移概率,并对待解析简历中的有效关键词增加前缀标注和后缀标注,对待解析简历的文本内容进行分段提取并输出。本发明能够基于n‑gram模型与词典分段技术进行自动化的简历解析,能够提高信息抽取准确率并支持不同文件格式,可为招聘网站、公司HR部门提供丰富的人才资源库。
技术研发人员:杨春明;张晖;李建飞;李波;赵旭剑
受保护的技术使用者:西南科技大学
技术研发日:2017.05.10
技术公布日:2017.09.08