【百度百科】文本数据挖掘

文本数据挖掘(Text Mining)是指从文本数据中抽取有价值的信息和知识的计算机处理技术。
中文名
文本数据挖掘
外文名
Text Mining
种    类
基于单文档的数据挖掘等
方    法
文本分类, 文本聚类

概念
顾名思义,文本数据挖掘是从文本中进行数据挖掘(Data Mining)。从这个意义上讲,文本数据挖掘是数据挖掘的一个分支。
文本挖掘种类
1.基于单文档的数据挖掘
2.基于文档集的数据挖掘
文本挖掘方法
1.文本分类
文本分类是一种典型的机器学习方法,一般分为训练和分类两个阶段。
文本聚类是一种典型的无监督式机器学习方法,聚类方法的选择取决于数据类型。
4.摘要
5.压缩
其中,文本分类和聚类是两种最重要最基本的挖掘功能。
挖掘工具
1.IBM DB2 intelligent Miner
2.SAS text miner
3.SPSS Text Mining
4.DMC TextFilter(纯文本抽出通用程序库)
应用
文本挖掘传统商业方面的应用主要有,企业竞争情报、CRM、电子商务网站、搜索引擎,现在已扩展到医疗、保险和咨询行业。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值