Datawhale 零基础入门NLP赛事-Task 1 赛题理解

**

Datawhale 零基础入门NLP赛事-Task 1 赛题理解

这个赛题是一个字符识别问题,要求选手对新闻文本进行分类。
赛题数据已经被匿名化处理,训练集中有20w条样本,测试集A包括5w条样本,测试集B包括5w条样本。数据集中标签的对应关系为{‘科技’: 0, ‘股票’: 1, ‘体育’: 2, ‘娱乐’: 3, ‘时政’: 4, ‘社会’: 5, ‘教育’: 6, ‘财经’: 7, ‘家居’: 8, ‘游戏’: 9, ‘房产’: 10, ‘时尚’: 11, ‘彩票’: 12, ‘星座’: 13}。
对于这道题,我们可以从特征提取分类模型两个部分着手。
解题思路:TF-IDF+机器学习分类器;FastText;WordVec+深度学习分类器;Bert词向量

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值