python同义词替换的实现(jieba分词)
更新时间:2020年01月21日 10:24:21 作者:Lty美丽人生
这篇文章主要介绍了python同义词替换的实现(jieba分词),文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧
TihuanWords.txt文档格式
注意:同一行的词用单个空格隔开,每行第一个词为同行词的替换词。
年休假 年假 年休
究竟 到底
回家场景 我回来了
代码
import jieba def replaceSynonymWords(string1): # 1读取同义词表,并生成一个字典。 combine_dict = {} # synonymWords.txt是同义词表,每行是一系列同义词,用空格分割 for line in open("TihuanWords.txt", "r", encoding='utf-8'): seperate_word = line.strip().split(" ") num = len(seperate_word) for i in range(1, num): combine_dict[seperate_word[i]] = seperate_word[0] print(seperate_word) print(combine_dict) # 2提升某些词的词频,使其能够被jieba识别出来 jieba.suggest_freq("年休假", tune=True) # 3将语句切分成单词 seg_list = jieba.cut(string1, cut_all=False) f = "/".join(seg_list).encode("utf-8") f = f.decode("utf-8") print(f) # 4返回同义词替换后的句子 final_sentence = " " for word in f.split('/'): if word in combine_dict: word = combine_dict[word] final_sentence += word else: final_sentence += word # print final_sentence return final_sentence string1 = '年休到底放几天?' print(replaceSynonymWords(string1))
结果
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持脚本之家。
相关文章
基于pdf2docx模块Python实现批量将PDF转Word文档的完整代码教程
这篇文章主要介绍了基于pdf2docx模块Python实现批量将PDF转Word文档的完整代码教程,PDF文件是一种常见的文档格式,如何转换成word呢,需要的朋友可以参考下2023-04-04Python生成验证码、计算具体日期是一年中的第几天实例代码详解
这篇文章主要介绍了Python生成验证码、计算具体日期是一年中的第几天,本文通过实例代码给大家介绍的非常详细,具有一定的参考借鉴价值,需要的朋友可以参考下2019-10-10一小时学会TensorFlow2之Fashion Mnist
这篇文章主要介绍了TensorFlow2之Fashion Mnist,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下2021-09-09对python3 Serial 串口助手的接收读取数据方法详解
今天小编就为大家分享一篇对python3 Serial 串口助手的接收读取数据方法详解,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧2019-06-06
最新评论