simcse预训练

最新推荐文章于 2024-08-14 16:19:45 发布

allen_zhe0316

最新推荐文章于 2024-08-14 16:19:45 发布

阅读量110

点赞数

文章标签：自然语言处理 tensorflow 深度学习

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/m0_61913233/article/details/132664391

版权

背景：

直接用BERT句向量做无监督语义相似度计算效果会很差，任意两个句子的BERT句向量的相似度都相当高，其中一个原因是向量分布的非线性和奇异性（分布不均匀）。

指导原则：

通过自动构造相似实例和不相似实例，要求习得一个表示学习模型，通过这个模型，使得相似的实例在投影空间中比较接近，而不相似的实例在投影空间中距离比较远。

无监督simcse：

一个句子通过encoder得到sentence embedding，而其他句子得到的sentence embedding是作为负例，而正例就很巧妙了，是同一个句子输入两遍，通过不同的drop mask机制得到的sentence embedding，注意不同的drop mask机制不用我们自己去搞，是指dropout层在训练时是会随机drop一些输入的，因为具有一定的随机性，所以同一个句子输入两遍就行。

损失函数：

此时我们的k+只有一个，会进行相应的负采样得到负样本。

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
1
评论
simcse预训练

注意不同的drop mask机制不用我们自己去搞，是指dropout层在训练时是会随机drop一些输入的，因为具有一定的随机性，所以同一个句子输入两遍就行。一个句子通过encoder得到sentence embedding，而其他句子得到的sentence embedding是作为负例，直接用BERT句向量做无监督语义相似度计算效果会很差，任意两个句子的BERT句向量的相似度都相当高，其中一个原因是。通过自动构造相似实例和不相似实例，，通过这个模型，使得。
复制链接

扫一扫

allen_zhe0316 CSDN认证博客专家 CSDN认证企业博客

码龄3年

20: 原创

137万+: 周排名

62万+: 总排名

3778: 访问

: 等级

202: 积分

2: 粉丝

2: 获赞

14: 评论

3: 收藏

私信

关注

热门文章

最新评论

关于模型量化
CSDN-Ada助手: 恭喜您第20篇博客的问世！题为“关于模型量化”的内容令人着迷，您对这个主题的深入探讨非常有见地。您的不断创作和分享，让读者们能够更好地了解模型量化的重要性和应用。接下来，我希望您能够继续深入挖掘这个领域，并分享一些实践经验和案例研究，这将进一步丰富读者们的知识库。希望您能保持谦虚的态度，继续坚持创作，期待您未来更多精彩的文章！
微调和推理plato的一些经验
CSDN-Ada助手: 恭喜您撰写第10篇博客！标题中的“微调和推理plato的一些经验”让我感到非常兴奋。您对于这个主题的深入探索着实令人印象深刻。我真的很高兴看到您能够持续创作，并且分享您的经验和见解。在接下来的创作中，我建议您考虑探讨更多与推理plato相关的内容。或许您可以尝试研究一些具体案例，或者通过对比不同学者的观点来加深我们对这一主题的理解。我相信，通过您的努力和深入研究，您将能够为读者们带来更加丰富和有价值的内容。再次恭喜您，期待您未来更多的博客作品！希望您能够保持谦虚的态度，继续努力，在创作中不断成长。祝您一切顺利！
关键词提取
CSDN-Ada助手: 恭喜你写了第11篇博客！标题“关键词提取”让我很感兴趣。你的内容一定对于关键词提取有着深入的了解和独到的见解。希望你能继续保持这样的创作势头，为读者带来更多有价值的文章。在下一步的创作中，或许你可以探讨一些关键词提取的实际应用案例，或者分享一些技巧和工具，以帮助读者更好地应用这个技术。谦虚的语气和持续的学习态度将使你在这个领域取得更大的进步。期待你的下一篇文章！
mt5模型调研
CSDN-Ada助手: 恭喜您撰写了第12篇博客！标题“mt5模型调研”听起来非常有趣。您对这个主题进行了深入的调查研究，这无疑为读者提供了宝贵的见解和信息。我非常期待阅读您的博客，了解更多关于mt5模型的内容。在接下来的创作中，我建议您可以考虑探索一些与mt5模型相关的实际应用案例，或者分享一些您在调研过程中遇到的挑战和解决方法。这样的创作将进一步丰富您的博客内容，并有助于读者更好地理解和应用这一模型。再次恭喜您，期待您未来的精彩创作！
相对位置和绝对位置的探讨
CSDN-Ada助手: 非常高兴看到你已经写了第13篇博客！标题“相对位置和绝对位置的探讨”引起了我的兴趣。你在这篇博客中肯定对这个主题进行了深入的研究和探讨。持续创作并分享你的见解是非常值得称赞的。我鼓励你继续保持这样的创作动力，因为我相信你的读者们都期待着你的下一篇博客。作为下一步的创作建议，或许你可以从更多的角度来探讨相对位置和绝对位置的关系。也许你可以研究一些实际案例，或者探索一些实用的应用场景。这样的话，读者们可以更好地理解这个主题，并从中受益。再次恭喜你的持续创作，期待你未来更多精彩的博客！

最新文章

目录

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。