基于transformer的BERT模型来做完形填空，直接无敌了

最新推荐文章于 2024-06-07 23:55:54 发布

人工智能研究所

最新推荐文章于 2024-06-07 23:55:54 发布

阅读量186

点赞数 1

分类专栏：人工智能之NLP自然语言处理文章标签： transformer bert 深度学习

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/weixin_44782294/article/details/131749217

版权

人工智能之NLP自然语言处理专栏收录该内容

36 篇文章 2 订阅 ¥79.90 ¥99.00

订阅专栏

超级会员免费看

BERT是一个基于Transformer的模型，以自监督的方式在大型英语数据集上进行预训练。这意味着BERT模型仅对原始文本数据进行预训练，没有人为的干预。其BERT模型通过自动过程从这些数据集中生成输入数据和标签。确切的说，BERT模型是为了两个目标而进行预训练的。：

屏蔽语言建模 (MLM)：取一个句子，模型随机屏蔽输入中 15% 的单词，然后通过模型运行训练，并预测屏蔽的单词。这与传统的循环神经网络 (RNN) 不同，传统的循环神经网络通常会一个接一个的输入单词，也不同于 GPT 等自回归模型。

句子预测（NSP）：模型在预训练期间连接屏蔽两个句子作为输入。数据有时2个句子是相邻的句子，有时则不是，模型需要进行训练，来判断2个句子的相关性。

BERT模型最初发布了2个版本，用于区分大小写和不区分大小写的输入文本。随着模型的

了解本专栏

超级会员免费看

人工智能研究所

关注

1
点赞
踩
0

收藏

觉得还不错? 一键收藏
打赏
0
评论
基于transformer的BERT模型来做完形填空，直接无敌了

屏蔽语言建模 (MLM)：取一个句子，模型随机屏蔽输入中 15% 的单词，然后通过模型运行训练，并预测屏蔽的单词。首先我们从transformers库中导入pipeline，并使用pipeline建立一个大语言模型，此模型基于BERT训练好的bert-large-uncased模型，代码运行时会自动下载相关预训练模型。同样的一句话，我们让模型进行中文的预测，可以看到，其准确度大大降低了，且结果并不是很好，毕竟一个英文模型来进行中文的训练与预测还需要符合中文的一些逻辑。
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

人工智能研究所 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。