微博舆情 之 特定话题情感分析

本文介绍一下在做微博特定话题情感分析中的做法,核心就是判断文本的情感极性,再根据这个极性来进行情感判定。

主要经过了以下几个步骤:

  • 文本预处理
    • 去乱码、去网络词
    • 利用LTP获取分词、句子结构及成分等信息
  • 情感信息提取
    • 在同义词词林里面找单词编码
  • 情感极性判断
    • 在情感基准库里面寻找单词极性
    • 用VSI 进行调整
    • 用VBS分析主题词极性
    • 计算句子极性

下面就按照这三部分分别介绍:

文本预处理

文本预处理中主要用了语言技术平台(Language Technology Platform,LTP),它是哈工大社会计算与信息检索研究中心历时十年研制的一整套开放中文自然语言处理系统。 LTP制定了基于XML的语言处理结果表示,并在此基础上提供了一整套自底向上的丰富、高效、高精度的中文自然语言处理模块。主要包含以下9个模块:
这里写图片描述

  1. 分句
  2. 分词:分词是基于字的序列标注问题,对于输入句子的字序列,模型给句子的每个字标注一个标识词边界的标记。
  3. 词性标注(Part-of-speech, POS):词性标注是给每个词一个词性类别(名词、动词、形容词等)的任务。
  4. 命名实体识别(Named Entity Recognition, NER):是在句子的词序列中定位并识别人名
  • 6
    点赞
  • 26
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值