网易主观题-答案记录

根据要求对文本进行分类
(1)分类主要是运用机器学习或着深度学习技术根据不同类别数据的定义将数据分到不同的类别中。它可以解决人工标记数据的繁琐,也可以在信息检索、精确推荐等领域为社会带来便利。
(2)数据获取-》数据预处理-》特征工程-》数据集划分-》模型选择-》模型评估
(3)模型选择。文本分类较少使用传统的机器学习算法,因为需要人工从文本中提取特征,一方面人工提取到的特征较少,另一方面人工提取到的大部分是统计特征,不具有语义信息,所以大部分使用深度学习来进行建模。常用的深度学习模型有CNN、RNN、LSTM以及最近较流行的transformer等。一般对于类别区分较明显的数据可以使用CNN进行建模,且模型不需要太复杂;对于分类的类别数较多或者需要进行细粒度分类的数据,需要模型提取到更多的语义信息才会有较好的效果,所以一般使用多层的RNN及其变体,但RNN是一种序列模型,训练只能顺序进行,所以往往需要较长的训练时间,此外,虽然理论上RNN可以保留距离较远处的信息,但当文本较长时,RNN效果并不好。解决的方法,目前基于“Attention Is All You Need”这篇论文,许多学者研究出了self-attention机制,从而避免使用RNN,且可以更好的提取到文本语义信息。

  • 1
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
分类:分类可以找出这些不同种类客户之间的特征,让用户了解不同行为类别客户的分布特征,从而进行商业决策和业务活动,如:在银行行业,可以通过阿里云机器学习对客户进行分类,以便进行风险评估和防控;在销售领域,可以通过对客户的细分,进行潜客挖掘、客户提升和交叉销售、客户挽留等 聚类:通常”人以群分,物以类聚”,通过对数据对象划分为若干类,同一类的对象具有较高的相似度,不同类的对象相似度较低,以便我们度量对象间的相似性,发现相关性。如在安全领域,通过异常点的检测,可以发现异常的安全行为。通过人与人之间的相似性,实现团伙犯罪的发掘 预测:通过对历史事件的学习来积累经验,得出事物间的相似性和关联性,从而对事物的未来状况做出预测。比如:预测销售收入和利润,预测用户下一个阶段的消费行为等 关联:分析各个物品或者商品之间同时出现的机率,典型的场景如:购物篮分析。比如超市购物时,顾客购买记录常常隐含着很多关联规则,比如购买圆珠笔的顾客中有65%也购买了笔记本,利用这些规则,商场人员可以很好的规划商品摆放问题。在电商网站中,利用关联规则可以发现哪些用户更喜欢哪类的商品,当发现有类似的客户的时候,可以将其它客户购买的商品推荐给相类似的客户,以提高网站的收入。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值