[中文语音识别后文本加标点] 文本数据增强方法

最新推荐文章于 2024-06-04 09:40:38 发布

MachineLP

最新推荐文章于 2024-06-04 09:40:38 发布

阅读量1.6k

点赞数

分类专栏：机器学习 Deep learning MachineLP成长记文章标签：文本数据增强方法

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/u014365862/article/details/104499067

版权

MachineLP成长记同时被 3 个专栏收录

24 篇文章 100 订阅 ¥39.90 ¥99.00

订阅专栏

292 篇文章 18 订阅

订阅专栏

175 篇文章 13 订阅

订阅专栏

本文探讨了数据增强技术在文本领域的应用，重点介绍了ICLR 2019 workshop论文提出的四种NLP数据增强方法：同义词替换、随机插入、随机交换和随机删除。这些方法有助于提升文本分类任务的性能。此外，还分享了一个名为textda的Python库，用于实现这些数据增强技术，并给出了使用示例。

摘要由CSDN通过智能技术生成

数据增强技术在很多领域应用广泛，例如：在图像领域中有：旋转、反转、噪声、mixup、cutmix等等；在语音识别领域有：语音信号添加随机背景噪声、语谱图随机mask等等......

在文本领域也有很多方法：其中 ICLR 2019 workshop论文《EDA: Easy Data Augmentation Techniques for Boosting Performance on Text Classification Tasks》介绍了几种NLP数据增强技术。

代码可以看这里：https://github.com/jasonwei20/eda_nlp/blob/master/code/eda.py

其中包括：

（1）同义词替换：不考虑stopwords，在句子中随机抽取n个词，然后从同义词词典中随机抽取同义词，并进行替换。

样例： “我非常喜欢这部电影” —> “我非常喜欢这个影片”，

了解本专栏

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
打赏
2
评论
[中文语音识别后文本加标点] 文本数据增强方法

数据增强技术在很多领域应用广泛，例如：在图像领域中有：旋转、反转、噪声、mixup、cutmix等等；在语音识别领域有：语音信号添加随机背景噪声、语谱图随机mask等等......在文本领域也有很多方法：其中ICLR 2019 workshop论文《EDA: Easy Data Augmentation Techniques for Boosting Performance on Te...
复制链接

扫一扫

专栏目录

MachineLP CSDN认证博客专家 CSDN认证企业博客

码龄10年

457: 原创

1万+: 周排名

8028: 总排名

259万+: 访问

: 等级

2万+: 积分

6368: 粉丝

1153: 获赞

785: 评论

2964: 收藏

私信

关注

热门文章

分类专栏

最新评论

机器学习-7：MachineLN之激活函数
CSDN-Ada助手: 哇, 你的文章质量真不错，值得学习！不过这么高质量的文章, 还值得进一步提升, 以下的改进点你可以参考下: (1)提升标题与正文的相关性。
tf18: 根据姓名判断性别
源头活水2023: 你找到了吗，我也想问网址？
从2D图片生成3D模型（3D-GAN）
有海的地方就是南: 这里是可以下载完整代码的吗
OpenCV之二值图像联通组件寻找
CSDN-Ada助手: 非常感谢CSDN博主的分享，这篇博客介绍了二值图像联通组件寻找，对于学习OpenCV的读者来说是非常有帮助的。我觉得下一篇博客可以继续探讨图像处理方面的技术，比如基于OpenCV的图像分割、图像识别等方面的实践。相信这样的技术文章对其他读者也会非常有帮助，期待更多的分享！为了方便博主创作，提高生产力，CSDN上线了AI写作助手功能，就在创作编辑器右侧哦～（https://mp.csdn.net/edit?utm_source=blog_comment_recall ）诚邀您来加入测评，到此（https://activity.csdn.net/creatActivity?id=10450&utm_source=blog_comment_recall）发布测评文章即可获得「话题勋章」，同时还有机会拿定制奖牌。
用kinect录视频库
張小魚: 换过dll了

最新文章

目录

评论 2

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

MachineLP 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。