哈工大的同义词词林,应该是上个世纪的产物,里面的词比较老旧,但好歹也能用
同义词词林的作用,跟word2vec的获取相近词函数比较类似,这两者发挥的功效比较,看具体的应用吧
1. 首先下载包含同义词的txt,CSDN上有链接:
http://download.csdn.net/download/answerme11/7307771
2. 得到txt的内容如下:
每一行由一系列的词条构成
每一行的行头的字母及数字编码表示类别
“=”代表“相等”、“同义”;
“
#”代表“不等”、“同
类”,属于相关词语;
“@”代表“自我封闭”、“独立”,它在词典中既没
有同义词,也没有相关词。
3.
python调用同义词词林的代码
def get_sym(w,word_set):
# w: input word