Word2vec进行中文情感分析

最新推荐文章于 2024-04-13 09:54:08 发布

瑶子ove

最新推荐文章于 2024-04-13 09:54:08 发布

阅读量4k

点赞数 2

分类专栏： NLP

本文链接：https://blog.csdn.net/weixin_40924580/article/details/83629615

版权

'''Chinese sentiment analysis'''from sklearn.cross_validation import train_test_splitfrom gensim.models.word2vec import Word2Vecimport numpy as npimport pandas as pdimport jiebafrom sklearn.e...

摘要由CSDN通过智能技术生成

'''
Chinese sentiment analysis
'''

from sklearn.cross_validation import train_test_split
from gensim.models.word2vec import Word2Vec
import numpy as np
import pandas as pd
import jieba
from sklearn.externals import joblib    #把数据转化为二进制
from sklearn.svm import SVC
import sys

'''
数据预处理：载入数据
           预处理
           切分训练集和测试集
'''
def load_file_and_processing():
    neg = pd.read_excel('H:/word2vect_3data/Chinese_data/neg.xls')
    pos = pd.read_excel('H:/word2vect_3data/Chinese_data/pos.xls')

    cw = lambda x:list(jieba.cut(x))                #jieba分词
    pos['words'] = pos[0].apply(cw)				#此处会报错，读取时给列命名，在apply jieba.cut()不会报错
    neg['words'] = neg[0].apply(cw)

    # use 1 for positive sentiment, 0 for negative
    y = np.concatenate((np.ones(len(pos)),np.zeros(len(neg))))

    x_train,x_test,y_train,y_test = train_test_split(np.concatenate((po

最低0.47元/天解锁文章

确定要放弃本次机会？

福利倒计时

: :

立减 ¥

普通VIP年卡可用

立即使用

瑶子ove

关注关注

2
点赞
踩
21

收藏

觉得还不错? 一键收藏
8
评论
Word2vec进行中文情感分析

'''Chinese sentiment analysis'''from sklearn.cross_validation import train_test_splitfrom gensim.models.word2vec import Word2Vecimport numpy as npimport pandas as pdimport jiebafrom sklearn.e...
复制链接

扫一扫